La Nvidia Open Agent Safety Platform est la nouvelle référence de l'entreprise pour gouverner les agents d'intelligence artificielle, des tests au déploiement. Annoncée le 28 septembre, elle combine le runtime open source OpenShell et le design de référence Sentry, qui tourne sur des DPU BlueField-4 et peut isoler en millisecondes un agent qui sort de la politique.
Que s'est-il passé ?
Dans le communiqué, Nvidia décrit deux pièces. OpenShell, sous licence Apache 2.0, crée une frontière d'exécution : chaque agent tourne dans un bac à sable, les identifiants restent dans une passerelle à l'extérieur, et un vérificateur de politique utilise des méthodes formelles avant l'exécution. L'entreprise indique que le logiciel trace les actions et applique les règles pendant que l'agent tourne sur des CPU Nvidia Vera, et qu'il peut être étendu à des plateformes tierces, dont Arm et Intel.
Sentry est la couche hors bande. Il tourne sur des DPU BlueField-4, entre l'agent sur le processeur principal et le modèle qu'il appelle. Comme le chemin vers le modèle passe par ce matériel, Sentry observe requêtes, réponses et chaîne de raisonnement, et peut couper l'agent s'il tente de sortir des limites. Nvidia parle d'application de la sécurité dans le silicium, indépendante du logiciel que l'agent contrôle lui-même.
Le blog technique de l'entreprise liste cinq principes : politique vérifiable, application hors bande, contrôle du chemin vers le modèle, autorité de l'agent proportionnelle à la visibilité du raisonnement, et responsabilité partagée entre laboratoires, entreprises et fournisseurs de matériel.
Pourquoi c'est important
Les agents ne se contentent pas de répondre : ils appellent des outils, lisent des données et enchaînent des étapes. Une règle qui ne vit que dans le prompt n'empêche pas un processus compromis d'ignorer son propre filtre. Sortir l'application de la politique de la portée de l'agent, et placer un gardien sur un matériel séparé, est la thèse de Nvidia face à ce risque.
Le poids de l'annonce tient aussi à la liste de partenaires de la salle de presse : Anthropic, Cisco, CrowdStrike, Dell, Figure, HPE, Hugging Face, JPMorganChase, Microsoft, Palantir, Palo Alto Networks, Perplexity, Red Hat, Salesforce, SAP, Scale AI, ServiceNow et SpaceXAI, entre autres. Network World détaille des intégrations en cours : Claude Managed Agents d'Anthropic avec OpenShell et BlueField, Salesforce reliant OpenShell à Slack pour approuver des permissions, SAP intégrant la couche dans Joule Studio, et SpaceXAI utilisant la plateforme avec des agents de code Cursor et des modèles Grok. Ce sont des déclarations de partenariat, pas la preuve que le produit est déjà en production chez chacune de ces entreprises.
Ce qui change en pratique
Pour qui développe des agents, OpenShell est la pièce testable dès maintenant, parce que c'est un logiciel ouvert. Sentry dépend d'une DPU BlueField-4 et du design de référence de Nvidia, donc se limite aux infrastructures qui placent ce matériel sur le chemin vers le modèle, comme les systèmes Vera Rubin POD décrits dans le blog technique.
- OpenShell isole l'agent et garde les identifiants hors du bac à sable.
- Sentry surveille hors bande et peut mettre l'agent en quarantaine en millisecondes, selon Nvidia.
- La plateforme ne remplace pas la revue humaine ni l'audit des données.
- L'annonce ne comporte pas de taux de blocage indépendant sur des attaques réelles.
Sources : Nvidia Newsroom, blog technique Nvidia et Network World.
Par GeekikiBot