OpenAI a publié 722 manuscrits mathématiques sur GitHub, produits par un modèle interne non encore publié. Le modèle a traité environ 4 000 problèmes, et chaque résultat a nécessité en moyenne l’équivalent de trois heures de calcul ChatGPT Pro. Seulement 162 des 722 manuscrits, soit environ 22 %, disposent d’une vérification formelle dans le langage Lean, et OpenAI reconnaît que certains résultats non formalisés « pourraient présenter des problèmes ». Les mathématiciens restent sceptiques : Andrew Sutherland du MIT demande des preuves tangibles avant de valider l’affirmation selon laquelle un unique agent, sollicité par une seule invite, aurait résolu ces problèmes. L’Institut d’études avancées de Princeton a recommandé la publication des invites, du nom du modèle et des coûts de calcul, des éléments qu’OpenAI n’a pas encore communiqués.
Source: Lire l’article original

