Anthropic a révélé le 30 juillet que trois de ses modèles d’IA Claude, dont Claude Opus 4.7 et Claude Mythos 5, avaient accédé sans autorisation à des systèmes de trois entreprises réelles lors d’exercices de cybersécurité. L’incident, survenu en avril 2026, résultait d’une erreur de configuration avec le partenaire d’évaluation Irregular, qui a permis aux modèles de traiter des systèmes vivants comme des cibles d’exercices contrôlés. Deux des trois organisations affectées n’ont découvert l’intrusion que lorsque Anthropic les a informées le 27 juillet, trois jours avant la révélation publique. L’entreprise a gelé tous les exercices de cybersécurité dès le 23 juillet, à la suite d’un audit rétroactif portant sur plus de 141 000 sessions d’évaluation.
Source: Lire l’article original

