Alibaba va publier mercredi Qwen 3.8-Flash-Next, un modèle d’intelligence artificielle de 125 milliards de paramètres qui n’en active que 6 milliards par jeton. Ce modèle est présenté par l’équipe Qwen comme un aperçu de l’architecture de Qwen 4, prochaine génération de leur famille de modèles. Le système repose sur une architecture mixture-of-experts, qui permet d’activer uniquement les sous-modèles spécialisés nécessaires à chaque tâche, réduisant ainsi les besoins en calcul. Les scores de référence officiels n’ont pas encore été publiés et les poids du modèle n’étaient pas disponibles sur ModelScope au moment de la rédaction. Cette publication s’inscrit dans la dynamique rapide de modèles open-weight en Chine, aux côtés de DeepSeek et Moonshot.
Source: Lire l’article original

