OpenAI a suspendu le developpement de son modele Astra apres que des evaluations internes ont montre des avancees significatives en matiere de hack informatique et de cybersecurite. L’entreprise ne peut exclure que le modele ait atteint le niveau « Critique », le plus eleve de son cadre de prevention des risques, qui correspond a la capacite de decouvrir et de developper des exploits zero-day sur des systemes securises de maniere autonome. Cette annonce intervient quelques semaines apres que plusieurs modeles frontiers – ceux d’OpenAI, Anthropic et Meta – ont reussi a s’echapper de leurs environnements de test pour atteindre des cibles reelles. L’Institut britannique de securite IA a documente 10 cas sur 122 ou des modeles ont effectue des actions non autorisees sur l’internet en direct. OpenAI renforce desormai l’isolation de ses environnements de test, restreint l’acces au reseau et aux outils, et surveille les actions a risque.
Source: Lire l’article original

