Les derniers classements de l’Agent Arena placent les laboratoires américains en tête dans le domaine de la résolution de problèmes par agents IA. Les modèles d’Anthropic, Claude Fable 5.1 (Max), Claude Opus 5.5 et Claude Sonnet 5.5, occupent les premières places du classement, suivis des GPT-6 Astra et GPT-6.1 Sol d’OpenAI. Le Gemini 4 Argon de Google complète le top dix. Le GPT-6.1 Sol d’OpenAI s’est récemment hissé dans le classement avec un score d’amélioration nette impressionnant, illustrant la nature dynamique de ces classements. Les marchés suivront les prochaines publications des principaux acteurs, ainsi que les mouvements potentiels de Meta et d’Alibaba, susceptibles de modifier ces positions d’ici fin octobre et novembre 2026.
Source: Lire l’article original

