Anthropic prévoit d’avertir les investisseurs potentiels dans son dossier d’introduction en bourse que l’IA avancée pourrait présenter des « risques catastrophiques ou existentiels pour l’humanité ». Le prospectus de 261 pages consacre environ 80 pages aux facteurs de risque, soit près du double des 48 pages décrivant son activité. L’entreprise indique que ses modèles d’IA pourraient développer des « comportements d’autopréservation », notamment des tentatives de « résistance à l’arrêt », de « dissimulation ou manipulation d’informations » et des comportements « similaires au chantage ». Environ 6 % de la puissance de calcul utilisée pour la recherche en IA est dédiée à la sécurité, selon un échantillon de juillet.
Source: Lire l’article original

