SpaceXAI a lancé Grok 4.7, un modèle d’intelligence artificielle pour la cybersécurité qui a obtenu un score composite de 56 sur l’Artificial Analysis Cyber Index, se hissant à égalité avec MiMo-V2.6-Pro en tête du classement. Ce benchmark mesure la capacité des agents d’IA à défendre les logiciels en identifiant les vulnérabilités, en les reproduisant et en proposant des correctifs fonctionnels au sein de bases de code réelles. Grok 4.7 a affiché un taux de réussite de 74% sur le test CyberGym-E2E-AA et un taux de réussite au premier essai de 68% sur CWE-Bench-AA. Le modèle présente cependant un coût élevé de 11,67 dollars par tâche, contre des modèles concurrents moins chers. Grok 4.7 est issu de SpaceXAI, l’entité née de la fusion avec xAI, et Elon Musk a mis en avant ce classement sur les réseaux sociaux.
Source: Lire l’article original

