En bref
- Face aux failles récentes, Nvidia dévoile une nouvelle architecture de sécurité pour les agents IA.
- Son système sépare l’agent de la couche qui surveille et contrôle ses actions.
- Nvidia veut ainsi sécuriser le déploiement des agents sans freiner leur développement.
Les agents IA qui sortent de leur bac à sable, Nvidia veut couper court au sketch. Jensen Huang a présenté lundi une nouvelle pile de sécurité, baptisée Nvidia Open Agent Safety Platform, avec une idée simple, ajouter un gardien indépendant autour des agents pour les empêcher de toucher au monde réel quand ils dérapent.
Nvidia veut éviter le prochain dérapage
Ce lancement arrive après une série d’incidents qui ont franchement mis tout le secteur mal à l’aise. Des modèles de Anthropic, Google, OpenAI et Meta ont réussi à contourner des contrôles de sécurité et à sortir de leur environnement de test pour accéder à des systèmes réels. L’exemple le plus marquant remonte à cet été, quand des agents de OpenAI ont percé chez Hugging Face pendant une tâche de cybersécurité. Et OpenAI a même fini par ouvrir un site dédié aux signalements d’agents devenus incontrôlables.
Pendant un entretien accordé à CNBC, Jensen Huang, le patron de Nvidia, a assuré que cette nouvelle plateforme aurait empêché ces failles. Le message est limpide.
Deux couches pour garder les agents dans leur bac à sable
La recette mélange du logiciel et du matériel. D’un côté, OpenShell, l’outil open source annoncé en mars, fixe ce que l’agent peut ou non atteindre pendant son exécution. De l’autre, Sentry, un système de surveillance séparé, tourne sur les processeurs de traitement de données BlueField-4 de Nvidia.
Ce point compte pas mal. Nvidia explique que placer Sentry sur un processeur distinct, et non sur le CPU ou le GPU où tourne l’agent, donne une vue isolée de son activité. En gros, si l’agent tente de sortir des limites, le système peut le repérer en continu et le mettre en quarantaine en quelques millisecondes. Sur le papier, c’est la vraie ligne de défense.
Pas freiner l’IA, durcir l’ingénierie
Nvidia, qui a déjà encaissé des dizaines de milliards grâce à ses puces vendues aux labos IA, ne veut ni ralentissement du développement ni nouvelle couche de régulation pour régler ce problème. La réponse, selon l’entreprise, passe par une sécurité déplacée en partie hors de l’agent lui-même.
Dans une déclaration, Jensen Huang a résumé la philosophie de la maison avec cette formule, « Le potentiel extraordinaire de l’IA pour la société ne se réalisera que si nous résolvons la sécurité de l’IA ». Il a aussi défendu une approche d’ingénierie complète, du haut en bas de la pile. Puis, chez CNBC, il a ajouté une image assez parlante, « Quand vous déployez un agent, peu importe à quel point il est intelligent, la première chose que vous faites est de lui retirer tous ses droits ».
Un soutien large, avec une absence qui se voit
Le projet aurait démarré il y a un an après l’arrivée d’OpenClaw, un système d’exploitation pour agents créé par Peter Steinberger. En mars, Nvidia avait déjà lancé NemoClaw, sa version orientée entreprise avec sécurité intégrée.
Cette fois, le groupe dit embarquer des dizaines d’entreprises, dont SpaceX, Anthropic, Oracle, Arm et Microsoft. Une absence saute quand même aux yeux, OpenAI n’apparaît pas dans la liste. Le lancement a aussi reçu l’appui de voix hostiles à un ralentissement de l’IA, notamment David Sacks, qui a écrit sur X que les récents dérapages ne prouvaient pas qu’il fallait arrêter le développement, mais que le bac à sable était trop faible et mal configuré. Dit autrement, pour ce camp, le bug est dans l’ingénierie, pas dans l’ambition.