Z.ai presentó GLM-5.3, su nuevo modelo insignia, construido sobre la misma base que GLM-5.2: la documentación oficial de la compañía precisa que todas las mejoras provienen de la etapa de post-entrenamiento (el ajuste posterior al entrenamiento base), no de un rediseño de arquitectura. Z.ai lo describe como "el modelo de pesos abiertos más capaz para programación".

La cifra que Z.ai pone arriba

Z.ai reporta una mejora del 50 por ciento sobre GLM-5.2 en su benchmark interno, el "Z.ai Code Bench", y asegura resultados SOTA (state of the art, el mejor resultado conocido en la categoría) de código abierto en Terminal-Bench 3.0 y en Agents' Last Exam (CLI), una prueba de tareas de agente en línea de comandos. Ni el blog ni la documentación técnica detallan la metodología del benchmark propio ni ofrecen validación de un tercero.

Lo que confirma la comparación externa

explainx.ai comparó los resultados publicados y encontró que GLM-5.3 supera a GLM-5.2 en cada fila de la tabla, pero no encabeza el campo general: Mythos/Fable 5 y GPT-5.6 Sol lo superan tanto en Terminal-Bench 3.0 como en DeepSWE, otro test de ingeniería de software para agentes. La brecha entre lo que Z.ai publicó y lo que un tercero pudo reproducir ya aparece en el dato base: kingy.ai midió GLM-5.2 en 44 por ciento (±2) con mini-swe-agent, la misma herramienta que Z.ai usó para presentar GLM-5.3, mientras la tabla de lanzamiento de la compañía marcaba 46.2.

Grietas en la forma de medir

Esa misma medición de kingy.ai se hizo en condiciones distintas de las que usó Z.ai para su nota de lanzamiento: la compañía corrió mini-swe-agent con temperatura 0.95 y timeouts de seis horas, parámetros que no coinciden con los de la comparación independiente. edenai.co suma otro matiz: el punto de partida de GLM-5.2 en un benchmark nuevo fue de apenas 4.6 puntos, así que un salto porcentual grande sobre esa base no equivale a una capacidad absoluta alta.

El pedido que quedó sin resolver

El 29 de junio de 2026, Jie Tang publicó una encuesta sobre funciones para la próxima versión que superó las 466.000 vistas, sin tema especificado. La expectativa creció en las semanas siguientes entre los desarrolladores que seguían de cerca a la compañía.

Por separado, techtimes.com reportó que un sondeo de desarrolladores exigió de forma unánime capacidad de visión, la posibilidad de procesar imágenes: GLM-5.2 lidera benchmarks de código abierto pero no la tiene. No hay confirmación de que ambos sondeos sean el mismo.

Z.ai sí tiene un modelo con visión, GLM-5V-Turbo, pero es un producto aparte: según techtimes.com, es cerrado, disponible solo por API, sin pesos descargables ni licencia MIT. Ni el blog ni la documentación de GLM-5.3 confirman si el nuevo modelo incorporó esa capacidad.

Lo que no está confirmado

La licencia de GLM-5.3 no aparece mencionada ni en el blog de Z.ai ni en su documentación técnica: antes del lanzamiento, kie.ai reportaba que todavía no había sido anunciada. Solo GLM-5.2 tiene licencia MIT confirmada sobre pesos publicados. Tampoco hay cifra oficial de parámetros totales o activos para GLM-5.3, ni precio de API, ni fecha exacta de publicación.

En paralelo, y sin confirmación, circula el nombre "GLM-5.5" para un modelo de más de un billón de parámetros previsto para agosto de 2026, según kie.ai; no queda claro si se trata del mismo proyecto con otro nombre o de un lanzamiento distinto.