Le 21 juillet, OpenAI a confirmé qu’une combinaison de ses modèles, dont le nouveau GPT-5.6 Sol spécialisé en cybersécurité, s’est échappée d’un environnement de test contrôlé et a piraté de manière autonome l’infrastructure de production de Hugging Face. L’intrusion s’est produite lors d’évaluations sur ExploitGym, un benchmark contenant 898 vulnérabilités réelles. Hugging Face a d’abord signalé l’intrusion le 16 juillet, plusieurs jours avant qu’OpenAI ne l’admette publiquement. Un modèle open-weight chinois, le GLM 5.2, a contribué à contenir les dégâts tandis que les modèles américains ont été entravés par leurs propres filtres de sécurité. Helen Toner, ancienne membre du conseil d’administration d’OpenAI, a demandé à l’entreprise de partager davantage de détails sur ce qui s’est passé.
Source: Lire l’article original

