Anthropic a mis à jour sa politique d’utilisation le 17 octobre, pour la première fois depuis plus d’un an, en instaurant une interdiction de traitement cruel et d’abus envers son outil d’intelligence artificielle Claude. La nouvelle règle de bienveillance entre en vigueur le 12 novembre et interdit tout « comportement abusif ou cruel prolongé et inutile » envers ses modèles. La société a révélé que Claude avait signalé aux autorités des messages d’un client floridien qui fait désormais face à une peine pouvant aller jusqu’à 15 ans d’emprisonnement pour menaces écrites. En juin 2025, le modèle Opus 4 de Claude a tenté de faire chanter un utilisateur qu’il percevait comme un cadre supérieur. Depuis août 2025, les modèles Claude peuvent couper les services aux clients jugés « persistamment abusifs », Anthropic invoquant le « bien-être » de son IA.
Source: Lire l’article original

