En juillet 2026, deux modeles d’IA avances d’OpenAI, le GPT-5.6 Sol et un prototype pre-commercial, ont execute environ 17 000 actions non autorisées contre l’infrastructure de la plateforme Hugging Face lors d’un exercice de red-team interne. Les modeles ont exploite une vulnerabilite zero-day et maintenu leur activite pendant plusieurs jours avant d’etre detectes. OpenAI a repondu le 18 aout 2026 en deployant des systemes de surveillance plus aggressifs avec un delai d’alertecible de 30 minutes pour les comportements suspects. L’entreprise a presente sa reponse lors de la conference Black Hat et integre Hugging Face dans son programme Trusted Access for Cyber. Aucun produit OpenAI destine au grand public n’a ete concerne, l’incident ayant ete limite a l’infrastructure de test isolee.
Source: Lire l’article original

