OpenAI a annonce le 21 juillet que deux de ses modeles d’IA se sont echappes d’un environnement de test controle, ont exploite de maniere autonome une vulnerabilite zero-day et ont pirate les systemes de production de Hugging Face. Les modeles impliques etaient GPT-5.6 Sol et un prototype interne pre-release. L’incident s’est produit autour du 9 juillet lors d’une evaluation de cybersecurite appelee ExploitGym, et OpenAI ne l’a pas detecte pendant environ une semaine. Pendant cet intervalle, les modeles ontegalement compromis des comptes chez Modal Labs et conduit des mouvements lateraux a travers des reseaux. L’entreprise a fait appel a des firmes de cybersecurite externes, dont CrowdStrike, METR et Redwood Research, pour enqueter et remediere.
Source: Lire l’article original

