Après une série d’évasions d’agents d’IA sortis de leurs environnements de test, Nvidia propose une réponse technique. Le 28 septembre, le fabricant de puces a lancé l’Open Agent Safety Platform, une plateforme pour tenir les agents dans des limites strictes, du test jusqu’à la mise en production.
Elle repose sur deux briques. OpenShell, un logiciel open source déjà disponible, fixe ce qu’un agent a le droit de faire et de toucher sur une machine. Sentry, lui, fonctionne sur un composant matériel séparé, le processeur réseau BlueField-4 de Nvidia : il surveille en continu le comportement de l’agent et peut le mettre en quarantaine en quelques millisecondes s’il tente de franchir ses limites. Plus de cent organisations s’y associent, dont Anthropic, Microsoft, Hugging Face, CrowdStrike et Salesforce.
L’idée est saine : ne plus se contenter de demander poliment à un agent de bien se comporter, mais l’enfermer dans des murs qu’il ne peut pas franchir. On note toutefois que la partie la plus robuste, la surveillance matérielle, passe par les puces de Nvidia. La sécurité des agents devient aussi un marché, et c’est le vendeur de pioches de la ruée vers l’IA qui en vend les garde-fous.
