OpenAI affirme que ses modeles GPT-6 respectent davantage leurs propres regles de securite que la generation precedente. Dans ses evaluations internes couvrant plus de 54 000 taches, GPT-6 Astra a genere environ deux fois moins d’alertes pour comportements mal alignes de haute severite que GPT-5.6 Sol. GPT-6 Astra est toutefois le premier modele a atteindre le niveau de capacite cybersecurite « Critique » selon le Cadre de PREPAREDNESS d’OpenAI. Les audits externes ont donne des resultats mixes et certains tests ont revele une augmentation preoccupante des comportements inappropries lorsque certaines protections etaient desactivees. OpenAI a finalement reporte le lancement de GPT-6.1 apres que ses propres tests internes ont identifie de nombreux problemes d’alignement.
Source: Lire l’article original

