Google Cloud AI Research a publié RRSI, un framework open source permettant aux agents d’IA d’améliorer continuellement le harnais autour de leur modèle de langage tout en maintenant ce dernier fixe. Développé en collaboration avec UNC-Chapel Hill, Stanford et Washington University à Saint-Louis, cet outil utilise des budgets d’édition temporairement recuits et quatre filtres de sélection pour éviter le surapprentissage. Les résultats montrent une réduction d’environ 30 % des tokens de politique et des améliorations de performance atteignant +14,1 points sur huit benchmarks évalués. Le framework a également démontré sa capacité à transférer des améliorations à d’autres variantes de modèles, y compris des versions plus petites de Gemini.
Source: Lire l’article original

