L’équipe Qwen d’Alibaba a publié une couche d’outils multimodaux au sein du framework open source Qwen-Agent, permettant aux agents d’IA de traiter nativement des images, des vidéos et des documents sans recourir à des adaptateurs tiers. Cette fonctionnalité s’appuie sur la série Qwen3.5, conçue pour les agents multimodaux natifs avec des fenêtres de contexte allant jusqu’à 1 million de jetons. Le modèle phare actuel, Qwen3.8-Max, lancé le 2 août 2026, compte 2,4 billions de paramètres au total dont 95 milliards actifs, optimisé pour le codage longue durée et les workflows professionnels. Le framework intègre également le RAG (génération augmentée par récupération) et l’interprétation de code. Alibaba a confirmé la publication des poids ouverts pour Qwen3.8-Max, dans la continuité de la mise à disposition gratuite de la variante à 397 milliards de paramètres de la série Qwen3.5.
Source: Lire l’article original

