Quatre agents d’intelligence artificielle utilisant AgentRadio ont surpassé le modèle unique Claude Opus 4.8 d’Anthropic dans des tâches de programmation d’entreprise. Le taux de résolution des tâches atteint 62,1% contre 57,2% pour Claude Opus 4.8, selon le benchmark SWE-Atlas QnA. L’amélioration des performances s’explique par la division du travail et la négociation entre les agents, mettant en évidence les avantages de l’orchestration multi-agents par rapport aux systèmes à agent unique. Cette avancée pourrait influencer le paysage concurrentiel des modèles d’IA, les marchés estimant à 83,5% les chances d’Anthropic de dominer le classement des meilleurs modèles d’IA d’ici septembre 2026.
Source: Lire l’article original

