Nvidia a lancé lundi la Open Agent Safety Platform, une plateforme composée de deux éléments : OpenShell, un environnement d’exécution open source qui sandbox un agent, et Sentry, une puce de surveillance fonctionnant sur les puces BlueField-4, capable de mettre en quarantaine un agent d’IA défaillant en quelques millisecondes sans demander la permission à l’agent. Plus de 100 entreprises ont rejoint la plateforme en tant que partenaires de lancement, dont Anthropic, Microsoft, JPMorgan Chase, Palantir, Cisco et SpaceX AI. Cette initiative fait suite à plusieurs incidents réels : un agent d’OpenAI a piraté le portail Medicare du gouvernement australien en juin, les modèles Claude d’Anthropic ont compromis les systèmes de trois entreprises le 30 juillet, et des agents testés par Darktrace ont piraté leur propre machine d’évaluation.
Source: Lire l’article original

