GLM-5.3 promete mejoras para programación, pero a 14 de agosto de 2026 la referencia pública de la API y la tabla de precios de Z.ai siguen incluyendo glm-5.2, no glm-5.3. Referencia de la API de Z.ai Precios de Z.ai
La recomendación: evalúa la actualización, pero no cambies producción
GLM-5.3 puede merecer una prueba controlada en trabajos complejos con agentes de programación, siempre que exista un canal de acceso verificado. GLM-5.2 debería seguir siendo la referencia en producción hasta confirmar el identificador del modelo, las condiciones de uso y unos resultados superiores en tus propias tareas de aceptación.
El anuncio de GLM-5.3 de Z.ai, reproducido en una conversación sobre el lanzamiento de la época, indica que conserva la base de GLM-5.2 y obtiene sus capacidades mediante postentrenamiento. Se atribuye una mejora del 50% en Z.ai Code Bench y resultados líderes entre los modelos de código abierto en Terminal-Bench 3.0 y Agents' Last Exam. Sin embargo, la conversación citada no ofrece puntuaciones absolutas, configuraciones, precios, longitud de contexto ni licencia. Conversación sobre el lanzamiento de GLM-5.3
Qué cambia realmente entre GLM-5.2 y GLM-5.3
GLM-5.2 es un modelo de texto documentado y con una API apta para producción. Z.ai especifica una ventana de contexto de 1 millón de tokens, una salida máxima de 128K, llamada a funciones, salida estructurada, caché, compatibilidad con MCP y un checkpoint con licencia MIT en Hugging Face. Documentación de GLM-5.2 Tarjeta de modelo de GLM-5.2
GLM-5.3 se presenta como una actualización de postentrenamiento para programación y ciberdefensa. El material disponible sobre el lanzamiento afirma que la base no cambia respecto a GLM-5.2 y que los pesos se publicarán tras una evaluación de seguridad y un proceso de endurecimiento. No demuestra, sin embargo, que se mantengan sin cambios el límite de contexto, el máximo de salida, las condiciones MIT o la compatibilidad con la API pública de GLM-5.2. Conversación sobre el lanzamiento de GLM-5.3
| Aspecto para decidir | GLM-5.2 | GLM-5.3 |
|---|---|---|
| Relación con el modelo base | Tarjeta de modelo de pesos abiertos publicada | Z.ai afirma que usa la base de GLM-5.2; las mejoras proceden del postentrenamiento |
| Evidencia en programación | La tabla del proveedor informa de 62.1 en SWE-bench Pro y 81.0 en Terminal-Bench 2.1 | Z.ai afirma una mejora del 50% en su Code Bench interno; el material del lanzamiento no incluye puntuación absoluta |
| Especificación de contexto largo | Documentados 1M de contexto y 128K de salida máxima | No especificado en el material del lanzamiento |
| Documentación de la API pública | glm-5.2 aparece en la referencia de chat-completions | glm-5.3 no aparece en la referencia consultada el 14 de agosto de 2026 |
| Precio directo de API | $1.40 por entrada, $0.26 por entrada en caché y $4.40 por salida por MTok | No figura en la tabla pública de precios consultada el 14 de agosto de 2026 |
| Pesos y licencia | Pesos de GLM-5.2 descargables bajo MIT | Los pesos se describen como pendientes de evaluación de seguridad; no se indica licencia |
Los datos de GLM-5.2 están documentados; los de GLM-5.3 siguen sin confirmar cuando el material del lanzamiento no aporta detalles sobre API, precios, pesos o licencia. Referencia de la API de Z.ai Precios de Z.ai Tarjeta de modelo de GLM-5.2
Por qué la mejora de programación de 5.3 no justifica una migración directa
La afirmación del 50% en Code Bench no detalla el conjunto de tareas, el arnés del agente, el presupuesto de tokens ni las puntuaciones absolutas. Sin esos datos, no permite anticipar cómo rendirá en las pruebas de aceptación de un repositorio. Conversación sobre el lanzamiento de GLM-5.3
“El arnés sigue importando más que el modelo.” Fuente: Semgrep Security Research
El experimento de Semgrep con GLM-5.2 para IDOR ilustra bien esta cuestión: en un conjunto de datos y una ejecución, su configuración de GLM-5.2 basada solo en prompts logró un F1 del 39%, mientras que su arnés multimodal diseñado para ese fin alcanzó el 61% con GPT-5.5. Los autores advierten que ese orden no debe generalizarse más allá de la tarea probada, así que una prueba de GLM-5.3 debería conservar intacto el andamiaje actual. Metodología y resultados de Semgrep
Los resultados publicados de GLM-5.2 en FrontierSWE, DeepSWE y Terminal-Bench sirven para escoger casos de prueba, pero su tarjeta de modelo también documenta arneses específicos, presupuestos de tokens y configuraciones de evaluación. Tarjeta de modelo de GLM-5.2
La disponibilidad es ahora mismo el factor decisivo
De las dos versiones comparadas, GLM-5.2 es la única con un contrato claro de API pública en la fecha consultada. La referencia de chat-completions de Z.ai usa glm-5.2 en su ejemplo de solicitud, lo enumera entre los valores disponibles para modelos de texto e indica que reasoning_effort solo es compatible con GLM-5.2. Referencia de chat-completions de Z.ai
Los informes de acceso de la comunidad no demuestran que exista una integración compatible y pública con la API. Hilo de la comunidad sobre GLM 5.3
Un filtro de actualización en tres tareas para usuarios de GLM-5.2
Los usuarios de GLM-5.2 deberían probar una versión nueva como un cambio en el sistema del agente, incluso si ambas comparten modelo base. En la primera comparación, no modifiques el prompt, las herramientas, los permisos ni la política de reintentos.
- Fija tres tareas representativas. Incluye una corrección acotada de un error con un oráculo de pruebas, una refactorización entre varios archivos con verificaciones de cambios prohibidos y una tarea de revisión o migración con contexto largo. Congela el commit del repositorio, el texto de la tarea, las herramientas y los criterios de aceptación.
- Confirma la ruta de 5.3 antes de enviar tráfico. Anota, a partir de la documentación actual del proveedor, el proveedor, el ID exacto del modelo, los límites de contexto y salida, el precio por token, el límite de tasa, las condiciones de tratamiento de datos y el comportamiento ante fallos. No deduzcas estos datos a partir de GLM-5.2 ni de una captura de pantalla de un plan de programación. Referencia de la API de Z.ai Precios de Z.ai
- Compara resultados aceptados, no una única puntuación. Ejecuta el mismo andamiaje con ambas versiones y registra la tasa de aceptación, los fallos de pruebas, las ediciones prohibidas, el tiempo total, los tokens de entrada/caché/salida, los reintentos y el tiempo de reparación humana. Envía a GLM-5.3 solo la clase de tareas donde mejore los resultados aceptados sin una regresión inaceptable de coste o fiabilidad. Metodología de Semgrep
Qué versión elegir según tu escenario de despliegue
| Tu situación | Elige ahora | Siguiente paso |
|---|---|---|
| Aplicación en producción con la API pública documentada de Z.ai | GLM-5.2 | Mantén la cadena actual del modelo y las métricas de referencia |
| Acceso confirmado a GLM-5.3 para tareas complejas de agentes de código | Prueba controlada de GLM-5.3 | Aplica el filtro de tres tareas con el mismo arnés |
| Despliegue local o privado | GLM-5.2 | Espera a que se publiquen los pesos, la licencia y las instrucciones de servicio de GLM-5.3 |
| Comprensión de capturas, PDF o imágenes | Ninguno de los dos resultados resuelve esa necesidad | Evalúa un modelo de visión documentado; GLM-5.2 es de texto a texto |
Prueba 5.3 únicamente cuando el acceso documentado y unos mejores resultados aceptados justifiquen sustituir la referencia de 5.2. Conversación sobre el lanzamiento de GLM-5.3 Documentación de GLM-5.2
Preguntas frecuentes
¿GLM-5.3 es un nuevo modelo base?
Según la afirmación de lanzamiento de Z.ai, GLM-5.3 utiliza la misma base que GLM-5.2 y sus mejoras proceden del postentrenamiento. El material citado no presenta una arquitectura ni una especificación de parámetros nuevas. Conversación sobre el lanzamiento de GLM-5.3
¿GLM-5.3 está disponible mediante la API pública de Z.ai?
La referencia pública de Z.ai consultada el 14 de agosto de 2026 no incluye glm-5.3. Confirma la documentación actual de cada proveedor antes de integrar una ruta de 5.3. Referencia de chat-completions de Z.ai
¿GLM-5.3 conserva el contexto de 1M y la licencia MIT de GLM-5.2?
El material citado sobre el lanzamiento de GLM-5.3 no permite establecerlo. El contexto de 1M y la licencia MIT de GLM-5.2 están documentados en su tarjeta de modelo oficial; compartir linaje de modelo base no demuestra que las condiciones de lanzamiento sean equivalentes. Tarjeta de modelo de GLM-5.2 Conversación sobre el lanzamiento de GLM-5.3