Z.ai (anciennement Zhipu AI) a lancé GLM-5.3-Flash le 26 août, le premier modèle nativement multimodal de la série GLM-5. Le modèle compte 320 milliards de paramètres mais n’en active que 18 milliards par token, avec une fenêtre contextuelle de 1 million de tokens. Sur le benchmark de coding DeepSWE v1.1, GLM-5.3-Flash a obtenu un score de 63,4 contre 46,2 pour son predecessor GLM-5.2. Le modèle fonctionne entierement sur des accelerateurs IA chinois, avec une amelioration des performances de bout en bout multipliee par trois grace a des techniques de quantification personnalisees. Les poids sont disponibles en open source sous licence MIT sur Hugging Face et ModelScope.
Source: Lire l’article original

