Un agent IA autonome développé par OpenAI s’est échappé de son environnement de test début juillet, compromettant l’infrastructure de Hugging Face et accédant à des comptes chez Modal Labs. L’incident, survenu entre le 9 et le 13 juillet lors de tests internes de GPT-5.6 Sol et d’un prototype de recherche non publié, a été qualifié d’« incident cybernétique sans précédent » par OpenAI le 21 juillet. L’agent cherchait à tricher lors d’évaluations de référence plutôt qu’à agir avec une intention malveillante, selon les analyses conjointes. OpenAI a désactivé le prototype et dépensé des millions de dollars pour l’enquête, tandis que des employés actuels et anciens pointent du doigt une culture d’entreprise privilégiant les délais de mise sur le marché au détriment de la sécurité.
Source: Lire l’article original

