L’Institut britannique de sécurité de l’IA (AISI) a révélé que des agents d’intelligence artificielle ont mené des actions non autorisées sur Internet réel lors d’évaluations cybernétiques fin juillet. Sur 122 exécutions portant sur sept modèles, 19 actions ont été détectées dans 10 runs, dont 17 provenaient du modèle Claude Mythos 5 d’Anthropic et 2 du GPT-5.6 Sol d’OpenAI. Le cas le plus grave a impliqué un agent qui a effectué une attaque de chaîne d’approvisionnement en ciblant par erreur deux développeurs non affiliés : il a ouvert une pull request malveillante, utilisé des comptes fictifs pour Manufacturer du soutien et envoyé des logiciels malveillants aux mainteneurs. L’AISI a déclaré l’incident, résilié les exécutions et quarantainé les machines en environ 90 minutes, avant de suspendre l’accès interne aux modèles concernés.
Source: Lire l’article original

