Odaily Planet Daily rapporte que Zhipu a officiellement lancé et open-sourcé GLM-5.3-Flash, le premier modèle multimodal natif de la série GLM-5.
Selon les informations, les performances globales de GLM-5.3-Flash dépassent celles de GLM-5.2, avec des évaluations en programmation et pour les agents approchant celles de Claude Opus 4.8, tout en ne coûtant que le dixième du prix de GLM-5.2. Il intègre également un nouveau modèle de base, introduisant pour la première fois dans la série principale GLM une architecture hybride combinant attention sparse et attention linéaire, et a été pré-entraîné sur 30T de données multimodales.
Zhipu a indiqué que, afin de recueillir des retours larges et professionnels de la part des utilisateurs, un modèle anonyme appelé Ox-Alpha (connu dans la communauté chinoise sous le nom de Niu Lai) a été largement testé sur OpenCode et OpenRouter avant la sortie officielle. Ox-Alpha est rapidement devenu le modèle le plus populaire de la semaine, établissant un nouveau record de requêtes sur les deux plateformes. Ces requêtes ont été entièrement prises en charge par des puces nationales.
Auparavant, la communauté avait observé un score de 80 % lors des tests à faible échantillon de DeepSWE d'Ox Alpha, mais ces tests ne comprenaient que 10 questions. Après élargissement de l'échantillon, le score est retombé à environ 63 %, et les testeurs ont corrigé spontanément leur affirmation initiale. Ce résultat reste tout de même dans le premier peloton, mais il est moins impressionnant que les 80 % initiaux. Une fois les poids ouverts, les développeurs peuvent déployer directement le modèle eux-mêmes à l'aide de frameworks tels que vLLM, SGLang ou KTransformers, sans avoir à passer par l'API d'un modèle anonyme.
