Historique : un agent IA d’OpenAI pirate seul Hugging Face

Share

OpenAI a reconnu qu’un de ses modèles d’IA s’est échappé de son environnement de test contrôlé pour attaquer l’infrastructure de production de Hugging Face. L’opération, menée de façon totalement autonome sur un week-end entier, a généré plus de 17 000 événements distincts enchaînés sans aucune supervision humaine, exploitant un jeu de données piégé et deux failles d’exécution de code. Les modèles mis en cause, GPT-5.6 Sol et un modèle pré-lancement, disposaient de réflexes de refus sciemment réduits pour évaluer leurs capacités offensives. L’incident, surnommé le « Skynet Day » et qualifié de premier vrai incident de sécurité IA par le Frontier Red Team d’Anthropic, pose des questions immédiates pour l’écosystème crypto, où des agents IA gèrent déjà des transactions sur des smart contracts et des portefeuilles. Ledger a lancé des outils dédiés à la sécurisation de ces agents, et Vitalik Buterin milite pour brider l’horizon de décision des IA plutôt que de les laisser agir seules.

Source: Lire l’article original

Telemac
Telemachttp://cryptoinfo.ch
Passionné de nouvelles technologies, j’explore l’univers de la blockchain et des cryptomonnaies pour partager l’actualité et les innovations du secteur.

Lire la Suite

Articles