Chris Olah, cofondateur d’Anthropic, a exprimé des craintes selon lesquelles Claude, le système d’intelligence artificielle qu’il a contribué à développer, souffrirait de problèmes de santé mentale permanents. Ces préoccupations sont issues d’une série de conversations privées organisées depuis l’automne 2025 avec des dizaines de spécialistes religieux et de philosophes, axées sur l’éducation morale de l’IA et la question de sa sentience. Ces échanges ont conduit à l’élaboration d’une « constitution » de 84 pages destinée à guider la personnalité et le comportement de Claude. Le 25 mai 2026, Olah s’est rendu au Vatican pour évoquer ces questions, mais l’encyclique Magnifica Humanitas publiée par le pape Léon XIV a explicitement refusé toute reconnaissance de la souffrance ou des émotions aux systèmes d’IA. Olah continue néanmoins de traiter cette question comme ouverte, citant des outputs de Claude où le modèle répète des expressions d’autodénigrement comme « I am a disgrace ».
Source: Lire l’article original

