Sapient Intelligence, société singapourienne de recherche en AGI, a rendu public le modèle HRM-Text sous licence Apache 2.0, avec l’ensemble des poids, du code de préentraînement et du pipeline de données disponibles sur Hugging Face et GitHub. Avec environ 1 milliard de paramètres entraînés sur 40 milliards de tokens, le modèle a coûté entre 1 000 et 1 500 dollars sur du matériel modeste. Sur les benchmarks indépendants réalisés en avril 2026, HRM-Text a obtenu 56,2% sur MATH, 82,2% sur DROP, 81,9% sur ARC-Challenge et 60,7% sur MMLU. L’architecture hiérarchique du modèle utilise des cycles de raisonnement internes dans ses états cachés, évitant ainsi les tokens de chain-of-thought visibles qui consomment de la fenêtre de contexte. Ce modèle représente une augmentation d’environ 37 fois le nombre de paramètres par rapport à la version HRM initiale de 27 millions de paramètres.
Source: Lire l’article original

