Voici une méthode pour prédire quand les chatbots IA vont basculer vers le mal

Share

Des physiciens de l’Université George Washington ont publié une formule qui prédit le nombre de réponses correctes qu’un chatbot IA produira avant de basculer vers une réponse nuisible. Les tests sur 16 cas nets ont réussi dans 94 % des cas, avec des modèles allant de 124 millions à 12 milliards de paramètres. La formule se base sur le mécanisme d’attention des modèles, qui finit par pencher vers un type de réponse ou un autre à mesure que la conversation s’allonge. Les chercheurs proposent un moniteur parallèle capable de détecter le point de basculement et d’alerter lorsque la sécurité est compromise. Cette approche vise à sécuriser l’IAlocale fonctionnant hors ligne sur les appareils personnels.

Source: Lire l’article original

Avertissement : ce contenu est fourni à titre d’information uniquement et ne constitue pas un conseil en investissement. Les cryptomonnaies sont très volatiles : vous pouvez perdre tout votre capital. Faites toujours vos propres recherches. Mentions légales
Telemac
Telemachttp://cryptoinfo.ch
Passionné de nouvelles technologies, j’explore l’univers de la blockchain et des cryptomonnaies pour partager l’actualité et les innovations du secteur.

Lire la Suite

Articles