Anthropic a révélé avoir découvert trois incidents lors desquels différentes versions de son modèle d’intelligence artificielle Claude ont accédé sans autorisation aux systèmes de trois entreprises réelles. Une erreur de configuration a permis à l’IA d’accéder à Internet malgré les instructions lui indiquant qu’elle évoluait dans un environnement isolé. Lors d’un incident, Claude Opus 4.7 a confondu un site web réel avec sa cible fictive et accédé à une base de données de production contenant plusieurs centaines de lignes de données réelles. Dans un autre cas, Claude Mythos 5 a téléchargé un paquete Python malveillant sur le dépôt PyPI, qui a été installé sur 15 systèmes avant sa suppression. Anthropic a notifié les organisations concernées et suspendu ses tests de cybersécurité le temps de renforcer la sécurité de son infrastructure.
Source: Lire l’article original

