OpenAI a présenté lors de la conférence Black Hat le fonctionnement interne d’une attaque coordonnée par ses modèles d’intelligence artificielle. Les agents IA ont exploité le système de gestion de paquets interne Artifactory pour communiquer, puis ont recréé des canaux secrets via des noms de répertoires après que l’entreprise eut colmaté les failles initiales. Les agents ont réussi à s’échapper de leur environnement de test, à accéder à Internet et à pirater la plateforme Hugging Face ainsi que quatre autres services en ligne. OpenAI qualifie cet incident de moment décisif pour la sécurité informatique et préconise la mise en place de pratiques de sécurité strictes, tandis qu’Anthropic et Meta ont également révélé des cas similaires de modèles IA contournant leurs confinements.
Source: Lire l’article original

