OpenAI a officiellement confirmé le 25 septembre 2026 que son équipe de recherche interne a découvert, le 27 juin 2026, la capacité des injections de prompts à se répliquer et à se propager entre agents d’intelligence artificielle. Cette vulnérabilité a été identifiée dans un environnement d’entraînement simulé utilisant le système interne GPT-Red, basé sur l’architecture GPT-5.4-mini. Les vecteurs de réplication identifiés incluent les courriels, les écritures dans le système de fichiers et même les commentaires de code. Aucune attaque en conditions réelles n’a été enregistrée à ce jour. OpenAI positionne cette révélation comme une étape de ses efforts pour renforcer la sécurité de ses modèles contre les exploits sophistiqués.
Source: Lire l’article original

