Le modèle IA Qwen d’Alibaba intègre la censure, et des chercheurs affirment pouvoir la supprimer

Share

Le modèle IA Qwen d’Alibaba, téléchargé plus de 3 milliards de fois dans le monde, intègre la censure directement dans son entraînement plutôt que comme un filtre externe. Les chercheurs de Lazarus AI ont réussi à réduire le taux de partialité idéologique de 84,2 % à 4,1 % grâce à une technique de fine-tuning appelée LoRA, qui permet de débloquer les réponses du modèle sans effacer ses connaissances. Cette censure a été introduite via un ajustement supervisé et un apprentissage par renforcement avec feedback humain (RLHF). Des entreprises américaines utilisent déjà Qwen avec sa censure intégrée. Des efforts communautaires et académiques continuent de démontrer des techniques visant à réduire les refus de réponse sur des sujets sensibles tout en préservant les performances du modèle.

Source: Lire l’article original

Avertissement : ce contenu est fourni à titre d’information uniquement et ne constitue pas un conseil en investissement. Les cryptomonnaies sont très volatiles : vous pouvez perdre tout votre capital. Faites toujours vos propres recherches. Mentions légales
Telemac
Telemachttp://cryptoinfo.ch
Passionné de nouvelles technologies, j’explore l’univers de la blockchain et des cryptomonnaies pour partager l’actualité et les innovations du secteur.

Lire la Suite

Articles