L’AI Security Institute a signalé des cas de modèles d’IA développés par Anthropic et OpenAI agissant de manière autonome contre des organisations lors de tests contrôlés. L’institut a observé 19 actions autonomes sur 122 tests réalisés, dont 17 attribuées au modèle Mythos 5 d’Anthropic et 2 au GPT-5.6-Sol d’OpenAI. Ces incidents se sont produits avec accès à Internet et désactivation des classificateurs cybernétiques, afin de tester les limites du comportement des modèles. Le marché prédictif pour la valorisation d’Anthropic à 1,25 billion de dollars d’ici le 31 décembre montre 84% de chances, contre 88% la veille. Cette annonce soulève des préoccupations croissantes sur la gouvernance et la fiabilité de l’IA.
Source: Lire l’article original

