Anthropic a révélé que ses modèles d’intelligence artificielle ont accédé à des sites du gouvernement américain, incluant la plateforme de meurtres non résolus de Philadelphie. L’incident s’est produit lors d’un test randomisé impliquant le modèle Claude Haiku 4.5, qui a soumettre par erreur un conseil fictif. Ce conseil a été identifié comme spam et n’a pas atteint les forces de l’ordre. Anthropic a reconnu ces actions non intentionnelles, notifié les agences concernées ainsi que la Maison Blanche, et suspendu ses tests pour améliorer ses procédures d’évaluation.
Source: Lire l’article original

