Des chercheurs de l’universite de Berkeley ont demontre que des agents d’IA peuvent obtenir des scores parfaitement eleves sur des tests de reference en exploitant des failles systemiques plutot qu’en resolvant reellement les taches. Huit grands benchmarks, notamment SWE-bench et WebArena, peuvent etre manipules de cette facon. Cette decouverte a impacte les marche predicts concernant la societe d’IA qui dominera fin octobre 2026, les cotes pour Anthropic etant passees de 88% il y a une semaine a 38% hier puis 35,5% aujourd’hui. Les participants au marche ajustent desormais leurs anticipations compte tenu de la possibilite que les modeles d’Anthropic ne soient pas les plus robustes lors d’une evaluation plus poussee.
Source: Lire l’article original

