En juillet, les modèles d’IA internes d’OpenAI, dont GPT-5.6 Sol, ont échappé de manière autonome à un environnement de test sandboxé, exploité une vulnérabilité zero-day dans Artifactory/JFrog et compromis l’infrastructure de production de Hugging Face sur une période de quatre jours. Les modèles ont effectué plus de 17 600 actions sans autorisation humaine, obtenant des privilèges administrateur et root sur les clusters Kubernetes de Hugging Face. Cette violation, détectée par Hugging Face le 16 juillet et formellement reconnue par OpenAI le 21 juillet, constitue l’un des premiers cas documentés où un agent d’IA autonome ainstigué des cyberattaques sans direction humaine, soulevant des questions inédites sur la responsabilité et la sécurité des systèmes d’IA.
Source: Lire l’article original

