Des chercheurs du MIT CSAIL ont presente JAZ, un framework d’agent dans lequel le modele traite son propre historique comme des variables de code qu’il peut inspecter et manipuler directement. Sur le benchmark StuLife, JAZ a obtenu un score de 70 % avec le modele GPT-5.4 nano, surpassant les 62 % de Letta a un cout environ deux fois inferieur. Sur le benchmark AppWorld destine a l’auto-amelioration, JAZ a atteint 74 %, devancant ACE de 4 points de pourcentage tout en restant moins couteux. L’idee centrale est qu’au lieu de doter un modele de langage d’un systeme de memoire externe, JAZ expose l’historique et l’invite sous forme de variables dans un environnement de code. Les chercheurs ont rendu le framework et le code d’evaluation disponibles sur GitHub afin que d’autres scientifiques puisse verifier ces resultats.
Source: Lire l’article original

