Odaily Planet Daily informa que Zhipu ha anunciado oficialmente el lanzamiento y la apertura del código de GLM-5.3-Flash, el primer modelo multimodal nativo de la serie GLM-5.
Se informa que el rendimiento general de GLM-5.3-Flash supera al de GLM-5.2, y sus evaluaciones en programación y Agentes ya están cerca de Claude Opus 4.8, pero su precio es solo la décima parte del de GLM-5.2. También incorpora un nuevo modelo base, introduciendo por primera vez en la serie principal GLM una arquitectura híbrida de atención dispersa y atención lineal, y se preentrenó con 30T tokens de datos multimodales.
Zhipu indicó que, con el fin de recopilar amplios y profesionales comentarios de los usuarios, realizó una prueba a gran escala del modelo anónimo Ox-Alpha (conocido en la comunidad china como Niu Lai) en OpenCode y OpenRouter antes del lanzamiento oficial. Ox-Alpha se convirtió rápidamente en el modelo más popular de la semana, estableciendo nuevos récords de volumen de solicitudes en ambas plataformas. Todo este tráfico de solicitudes fue respaldado por capacidad de cómputo proporcionada por chips nacionales.
Anteriormente, la comunidad logró un 80% en las pruebas de DeepSWE de Ox Alpha con una muestra de solo 10 preguntas. Al aumentar la muestra, el rendimiento bajó a aproximadamente un 63%, y los evaluadores corrigieron voluntariamente la afirmación inicial. Este resultado aún se encuentra en el primer grupo, pero no es tan espectacular como el 80% inicial. Tras abrir el peso del código, los desarrolladores pueden implementarlo directamente con marcos como vLLM, SGLang y KTransformers, sin necesidad de recurrir a la API de modelos anónimos.
