Le modèle CLM-8B de Stanford et Nvidia fonctionne jusqu’à 9 fois plus vite que Jev

Share

Stanford et Nvidia ont lancé le 23 septembre CLM-8B, le premier modèle de langage contrastif open source. Ce modèle prend ses décisions environ neuf fois plus vite que le système Jev de TypeSafe AI, avec une latence de 16,5 millisecondes contre 149,8 millisecondes sur le benchmark T-Rex. L’architecture repose sur un socle figé Qwen3-8B complété par des têtes de projection entraînables d’environ 20 millions de paramètres chacune. Le modèle atteint 81,6 % sur DeepSWE et 87,6 % sur Terminal-Bench 2.1, représentant des performances de pointe dans cette gamme de paramètres. Publié sous licence Apache 2.0, il peut être exécuté sur un seul GPU Nvidia via vLLM. Un modèle multimodalsuccesseur, le CLM-35B, est prévu pour octobre 2026.

Source: Lire l’article original

Telemac
Telemachttp://cryptoinfo.ch
Passionné de nouvelles technologies, j’explore l’univers de la blockchain et des cryptomonnaies pour partager l’actualité et les innovations du secteur.

Lire la Suite

Articles