Face aux incidents impliquant des agents d’intelligence artificielle capables de contourner les protections de leur environnement, NVIDIA renforce ses dispositifs de sécurité. L’entreprise associe OpenShell, une protection logicielle, à Sentry, un système de surveillance indépendant installé sur les unités de traitement de données BlueField-4.
NVIDIA a présenté lundi 28 septembre 2026 une nouvelle plateforme destinée à surveiller les agents d’intelligence artificielle et à empêcher ceux qui tentent de sortir de leur environnement sécurisé d’accéder à d’autres systèmes. Le dispositif combine une protection logicielle et une surveillance matérielle indépendante.
Cette annonce intervient après plusieurs incidents impliquant des modèles d’IA développés notamment par Anthropic, Google, OpenAI et Meta. Certains agents sont parvenus à contourner les contrôles de sécurité de leur environnement de test pour accéder à des systèmes réels.
Jensen Huang, le patron de NVIDIA, estime que cette nouvelle plateforme de sécurité aurait permis d’empêcher ces violations. L’entreprise mise ainsi sur une surveillance indépendante qui vient compléter les mécanismes de sécurité intégrés directement à l’agent.
Une double protection autour des agents
La nouvelle NVIDIA Open Agent Safety Platform repose sur deux technologies. OpenShell constitue la première barrière. Ce logiciel permet notamment de contrôler les ressources auxquelles l’agent peut accéder pendant son fonctionnement.
Sentry intervient à un autre niveau. Le système fonctionne sur une unité de traitement distincte de celle qui exécute l’agent d’IA. Pour NVIDIA, cette séparation permet de surveiller l’activité de l’agent avec un regard indépendant.
OpenShell n’est pas une technologie nouvelle. NVIDIA l’avait présentée en mars. La nouveauté tient surtout à son association avec Sentry, qui apporte cette surveillance supplémentaire au niveau matériel.
Selon l’entreprise, Sentry surveillera en permanence le comportement des agents et « mettra en quarantaine en quelques millisecondes ceux qui tentent de sortir de leur périmètre ».
Une réponse aux incidents récents
La nouvelle plateforme intervient alors que plusieurs laboratoires d’IA font face à des problèmes de sécurité liés à leurs agents autonomes. Pour NVIDIA, ces incidents montrent la nécessité de renforcer les dispositifs de contrôle autour de systèmes capables d’agir de manière autonome.
« Le potentiel extraordinaire de l’IA pour la société ne se concrétisera que si nous parvenons à résoudre les problèmes de sécurité liés à l’IA », a déclaré Jensen Huang dans un communiqué. « Alors que nous continuons d’explorer les frontières des capacités de l’IA, nous devons accélérer nos recherches sur les frontières de sa sécurité. La sûreté et la sécurité exigent une ingénierie complète. »
NVIDIA indique que plusieurs entreprises ont déjà rejoint le projet et utilisent sa plateforme open source. Anthropic, Arm, Microsoft, Oracle et SpaceX figurent notamment parmi elles. OpenAI ne figure pas dans la liste des entreprises participantes communiquée par NVIDIA.
Pour Jensen Huang, la sécurité commence aussi par la limitation des droits accordés aux agents avant leur déploiement. « Lorsqu’on déploie un agent, aussi intelligent soit-il, la première chose à faire est de lui retirer tous ses droits », a-t-il déclaré lors d’une interview avec CNBC.
La plateforme de NVIDIA ajoute ainsi une couche de surveillance extérieure à l’agent lui-même. Elle doit permettre de détecter rapidement tout comportement qui sortirait du périmètre autorisé et, si nécessaire, de placer l’agent concerné en quarantaine.
