Première évaluation de l’IA en double aveugle testée à grande échelle

Share

La conférence AAAI-26, l’un des principaux événements de recherche en intelligence artificielle, a déployé des évaluations générées par l’IA pour 22 977 articles soumis à son programme principal, soit la première mise en œuvre à grande échelle de l’examen par les pairs assisté par l’IA lors d’une conférence académique majeure. Les sondages menés après le pilote ont révélé que les auteurs et les membres du comité de programme ont préféré les évaluations générées par l’IA à celles des examinateurs humains, notamment pour leur précision technique et la qualité de leurs suggestions de recherche. Le système fonctionnait dans un cadre en double aveugle, où ni les auteurs ni les examinateurs ne connaissaient l’identité de l’autre, et les évaluations de l’IA s’ajoutaient aux évaluations humaines pour chaque article. L’objectif était de compléter le travail des examinateurs humains et non de les remplacer, les évaluations de l’IA s’étant clairement identifiées comme telles. Les résultats complets de cette étude seront publiés en août 2026.

Source: Lire l’article original

Telemac
Telemachttp://cryptoinfo.ch
Passionné de nouvelles technologies, j’explore l’univers de la blockchain et des cryptomonnaies pour partager l’actualité et les innovations du secteur.

Lire la Suite

Articles