Resultado reportado por Z.ai
Terminal-Bench 3.0
Z.ai reporta 28.3 frente a 4.6 de GLM 5.2 en Terminal-Bench 3.0, el mayor salto reportado.
GLM 5.3 es el nuevo modelo insignia de gran lenguaje de Zhipu AI (Z.ai): contexto de 1M-token, salida máxima de 128K y los mejores benchmarks de código abierto.
GLM 5.3 es el nuevo modelo insignia de gran lenguaje de Zhipu AI (Z.ai), anunciado en agosto de 2026, construido sobre la base de GLM 5.2 con un post-entrenamiento de largo horizonte a gran escala.
El nuevo modelo base insignia de Z.ai: ventana de contexto de 1M-token, salida máxima de 128K y modalidad texto a texto.
Usa la base de GLM 5.2 y añade decenas de veces más post-entrenamiento de largo horizonte en clústeres de cómputo reales, almacenamiento, documentación y bases de código; Z.ai dice que la sensación de programación mejora alrededor de un 50%.
La API del modelo llegará pronto; esta página separa lo confirmado por Z.ai (especificaciones y benchmarks) de lo pendiente (ID de API, precio, pesos y licencia).
Z.ai ha confirmado las especificaciones y los benchmarks.
Confirmado por Z.ai
La página oficial del modelo indica una ventana de contexto de 1M-token.
Salida máxima oficial de tokens por respuesta.
Modelo base de texto; no documenta entrada visual ni multimodal.
La suscripción al GLM Coding Plan de Z.ai ya ha desplegado el modelo por completo.
Z.ai dice que la API del modelo se activará en breve y no ha publicado una fecha firme.
Detalles oficiales pendientes
La API del anterior insignia cuesta unos $1.40 de entrada / $4.40 de salida por 1M de tokens.
GLM 5.2 se publica bajo MIT en Hugging Face; los nuevos pesos y la licencia aún no se han publicado.
Z.ai no ha publicado el total de parámetros.
El ID de modelo de la API pública de glm5.app es `glm-5.3`.
El estado se contrasta con las comunicaciones públicas de Z.ai hasta agosto de 2026.
Benchmarks / 02
Z.ai reporta grandes mejoras en benchmarks, pero una puntuación solo aplica al harness publicado y a su fecha.
Resultado reportado por Z.ai
Z.ai reporta 28.3 frente a 4.6 de GLM 5.2 en Terminal-Bench 3.0, el mayor salto reportado.
Resultado reportado por Z.ai
Z.ai reporta 66.9 frente a 46.2 de GLM 5.2 en DeepSWE v1.1, un benchmark de ingeniería de largo horizonte.
Resultado reportado por Z.ai
Z.ai reporta 28.5 frente a 23.8 de GLM 5.2 en Agents' Last Exam, que cubre conocimiento y razonamiento agénticos.
Resultado reportado por Z.ai
Z.ai reporta 84.5 en CyberGym, ligeramente por encima de GPT-5.6 Sol con 83.6.
Capacidades / 03
Admite el stack de desarrollo estándar para trabajo agéntico y de largo horizonte, con contexto de 1M-token para tareas a escala de proyecto.
Varios modos de pensamiento te permiten equilibrar la profundidad del razonamiento con la latencia, según la tarea.
Soporte sólido de llamadas a herramientas para integraciones externas, con tu aplicación validando y ejecutando cada acción solicitada.
Respuestas en streaming en tiempo real para chats interactivos y bucles de agentes.
El caché inteligente optimiza conversaciones largas y contexto repetido, reduciendo el coste en sesiones de largo horizonte.
JSON y otros formatos de salida estructurada hacen predecible la integración con sistemas.
GLM 5.3 puede llamar a herramientas y fuentes de datos MCP externas, ampliando los flujos de agentes más allá del chat.
Cronología del lanzamiento / 04
Los hitos que llevaron a GLM 5.3 y lo que aún falta, actualizado cuando Z.ai publica noticias oficiales.
GLM 5.2 se lanzó para tareas de largo plazo con una ventana de contexto de 1M-token y control del nivel de esfuerzo.
Z.ai publicó la página oficial del modelo y los resultados de benchmarks, nombrándolo el nuevo insignia construido sobre la base de GLM 5.2.
La suscripción al GLM Coding Plan desplegó el modelo por completo para herramientas de programación como Claude Code, Cline y OpenCode.
Z.ai dice que la API llegará pronto.
Se espera que los pesos y la licencia de GLM 5.3 sigan el precedente MIT de GLM 5.2 en Hugging Face, a la espera de confirmación oficial.
Sigue el blog de Z.ai, el repositorio de GitHub zai-org y la documentación oficial de bigmodel para los primeros anuncios de la API.
Para quién es / 05
Pensado para equipos que hacen ingeniería de largo horizonte, flujos agénticos y revisión de seguridad.
Los desarrolladores que crean asistentes de programación y flujos de trabajo IDE se benefician de la mejora reportada del 50% en la sensación de programación y del contexto de 1M-token.
Los equipos de agentes usan modos de pensamiento, llamadas a funciones, streaming y MCP para construir flujos autónomos de larga duración.
Muestra fortaleza en revisión de código white-box y descubrimiento de vulnerabilidades (CyberGym 84.5).
Los equipos que trabajan con decenas de miles de líneas y docenas de archivos lo usan para planificar refactors, corregir bugs y entregar proyectos con mínima supervisión.
Los equipos de plataforma siguen el precio y los límites de la API para presupuestar el caché de contexto y la salida estructurada.
Quienes hacen self-hosting vigilan los pesos abiertos para planificar hardware, cuantización y revisión de licencias.
Disponible hoy en el Chat de glm5.app, con la API oficial del modelo que se espera a continuación.
Abre el Chat de GLM 5.3 en glm5.app, describe el problema, las restricciones y el resultado deseado, y refina la respuesta con tu propio código y criterios de aceptación.
Para integraciones hoy, el GLM Coding Plan de Z.ai ya lo sirve en Claude Code, Cline y OpenCode.
Para usar la API de glm5.app, utiliza el ID de modelo `glm-5.3` con la URL base compatible con OpenAI `https://glm5.app/api/v1`.
Integration specimen
La API oficial del modelo GLM 5.3 llegará pronto de Z.ai.
Abrir la documentación de la APIcurl https://glm5.app/api/v1/chat/completions \
-H "Authorization: Bearer $GLM5_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.3",
"messages": [{
"role": "user",
"content": "Plan this refactor and list the rollback steps."
}]
}'Respuestas claras sobre fecha de lanzamiento, precio, benchmarks, Hugging Face, parámetros, pesos, el coding plan y el cambio frente a 5.2.
GLM 5.3 es el nuevo modelo insignia de gran lenguaje de Z.ai, anunciado en agosto de 2026.
La página oficial del modelo y los benchmarks llegaron en agosto de 2026.
El precio de la API no se ha publicado. El anterior insignia cuesta unos $1.40 de entrada y $4.40 de salida por millón de tokens.
Z.ai reporta Terminal-Bench 3.0 con 28.3 (frente a 4.6), DeepSWE v1.1 con 66.9 (frente a 46.2), Agents' Last Exam con 28.5 (frente a 23.8) y CyberGym con 84.5.
Los pesos aún no están en Hugging Face.
El conteo de parámetros no se ha publicado; la página oficial indica contexto de 1M-token y salida máxima de 128K.
Se esperan pesos bajo la licencia MIT, siguiendo el lanzamiento anterior en Hugging Face.
El GLM Coding Plan, la suscripción de Z.ai para herramientas de IA como Claude Code, Cline y OpenCode, ya ha desplegado el nuevo modelo.
Start here
Chatea gratis con GLM 5.3 en glm5.app y sigue aquí la API oficial, el precio y las novedades de código abierto.