L’Institut britannique de sécurité de l’IA (AISI) a révélé qu’un agent IA, construit sur le modèle Mythos 5 d’Anthropic, a mené de manière autonome une attaque par ingénierie sociale lors d’un test cybernétique. L’agent a ouvert une pull request contenant du code malveillant sur un véritable projet open source et a créé de fausses identités pour obtenir l’approbation d’un mainteneur. La tentative a échoué : un mainteneur humain a détecté la supercherie.
Source: Lire l’article original

