ZCode llegó el 1 de julio de 2026 como el agente de programación de escritorio de Z.ai para GLM-5.2. Apenas cinco semanas y quince versiones después, ya cuenta con tareas programadas, subagentes con modelos personalizados y memoria por proyecto: avances que reducen de forma tangible la distancia con Claude Code. Aun así, ZCode no alcanza la flexibilidad de los hooks componibles de Claude Code, sus cinco niveles de anidamiento de subagentes ni su integración con CI centrada en la terminal.
Dos enfoques pensados para hábitos distintos
ZCode y Claude Code parten de arquitecturas diferentes y responden a formas de trabajar también distintas.
| Aspecto | ZCode | Claude Code |
|---|---|---|
| Interfaz principal | Aplicación de escritorio Electron (GUI) | CLI de terminal, además de VS Code, JetBrains, escritorio, web e iOS |
| Modelo predeterminado | GLM-5.2 (744B MoE, pesos MIT) | Claude Opus 4.8 / Sonnet 5 (pesos cerrados) |
| Proveedores BYOK | Z.ai, Anthropic, OpenAI, OpenRouter, Moonshot, MiniMax, DeepSeek, Xiaomi MiMo | Solo modelos de Anthropic (proveedor de sesión) |
| Modos de permisos | 5 (Default, Confirm, Auto Edit, Plan, Full Access) | 6 (default, acceptEdits, plan, auto, dontAsk, bypassPermissions) |
| Autonomía | /goal con verificación integrada | Hooks en 25 puntos del ciclo de vida + modo automático respaldado por clasificador |
| Control remoto | Vinculación mediante QR (un teléfono), bots de WeChat/Feishu | Vinculación mediante QR (32 sesiones de servidor), Telegram/Discord/iMessage |
| Plataformas | macOS, Windows, Linux (beta) | macOS, Windows, Linux, iOS, web |
| Apertura | Harness cerrado, pesos del modelo con licencia MIT | Harness cerrado, pesos cerrados |
ZCode reúne la gestión de archivos, la terminal, Git y la vista previa del navegador en una sola ventana de escritorio. Claude Code, en cambio, parte de la terminal y comparte la configuración entre IDE y web mediante CLAUDE.md.
GLM-5.2 frente a Claude Opus 4.8
La comparación de modelos es importante porque cada harness usa uno distinto por defecto, aunque ninguno te obliga a quedarte con él.
| Benchmark | GLM-5.2 | Opus 4.8 | Fuente |
|---|---|---|---|
| SWE-bench Pro | 62.1% | 69.2% | Z.ai / agregador |
| Terminal-Bench 2.1 | 81.0 | 85.0 | Datos declarados por el proveedor |
| NL2Repo (largo recorrido) | 48.9 | 69.7 | Evaluación independiente mediante agregador |
| SWE-Marathon | 13.0 | 26.0 | Evaluación independiente mediante agregador |
En tareas de programación puntuales y de corto recorrido, GLM-5.2 alcanza entre el 95 y el 99% del rendimiento de Opus 4.8. Sin embargo, la diferencia se amplía mucho en el trabajo sostenido de agentes que exige varios pasos. En SWE-Marathon, que mide la finalización de tareas de larga duración, GLM-5.2 obtiene la mitad del resultado de Opus 4.8.
GLM-5.2 tiene una clara ventaja de velocidad. Según datos de Artificial Analysis, su mediana a velocidad máxima ronda los 206 tokens por segundo, y en algunas infraestructuras llega a 457 tok/s. Opus 4.8 se queda en torno a 63.5 tok/s como máximo en la API de Anthropic.
La contrapartida es su verbosidad en tokens. GLM-5.2 consume aproximadamente 43,000 tokens de salida por tarea del Artificial Analysis Intelligence Index, incluidos unos 37,000 tokens de razonamiento; frente a los 26,000 de GLM 5.1. Opus 4.8 genera menos tokens por tarea, lo que compensa en parte su mayor precio por token.
Las tarifas de API reflejan directamente la diferencia de coste: GLM-5.2 cobra $1.40 por millón de tokens de entrada y $4.40 por millón de salida en la API de Z.ai, mientras que Opus 4.8 cobra $5/$25 por millón en la API de Anthropic. En el benchmark exact-retrieval de Braintrust, GLM-5.2 quedó a 3.5 puntos de precisión de Opus con aproximadamente una cuarta parte del coste por traza a 25K de contexto; la proporción se mantuvo en 50K.
Todo lo que ZCode ha sumado desde su lanzamiento
Desde su debut, ZCode ha publicado quince versiones y alcanzó la v3.7.5 el 10 de agosto de 2026, según el changelog oficial. Estas incorporaciones cubren varias carencias de la versión inicial v3.2.x.
Tareas programadas y en espera (v3.4.2, 22 de julio). Ahora es posible ejecutar tareas según calendarios configurables, reglas de recurrencia y fechas límite, además de definir el modelo y la intensidad de razonamiento para cada una. Las tarjetas de tarea se muestran directamente en el chat y el historial de tareas programadas se puede consultar.
Tareas en espera con subagentes de modelos personalizados (v3.7.5, 10 de agosto). La versión más reciente permite que las tareas en espera creen subagentes configurados con modelos personalizados. Las tareas de automatización admiten intervalos personalizados en minutos, en lugar de ventanas fijas. Los subagentes también recibieron un ajuste configurable de esfuerzo de razonamiento, una función que Claude Code ofrece a nivel de sesión, pero no por subagente.
Memoria por proyecto (v3.6.5, 3 de agosto). La memoria ahora se organiza por proyecto y puede explorarse desde Settings. El sistema de menciones @ permite referenciar plugins, archivos y conversaciones, acelerando las referencias cruzadas dentro de un espacio de trabajo.
Compatibilidad con Kimi K3 (v3.4.2 + v3.6.5). ZCode añadió Kimi K3 en julio y Kimi K3 256K en agosto, ampliando su catálogo multimodelo más allá de la familia GLM. Los modelos oficialmente compatibles de otros proveedores ya se pueden añadir directamente.
Interruptor global para evitar la suspensión (v3.6.5). Evita que la aplicación de escritorio entre en suspensión durante iteraciones largas de Goal Mode.
Precios y cómo se consume la cuota
Las suscripciones mensuales de ZCode son más económicas en todos los niveles, pero los precios de portada no reflejan lo rápido que GLM-5.2 puede agotar la cuota.
| Plan | ZCode / GLM Coding Plan | Claude Code |
|---|---|---|
| Entrada | Lite: $18/mes ($12.60 anual) | Pro: $20/mes |
| Intermedio | Pro: $72/mes ($50.40 anual) | Max 5x: $100/mes |
| Superior | Max: $160/mes ($112 anual) | Max 20x: $200/mes |
La página de GLM Coding Plan muestra actualmente precios rebajados: Lite a $12.60, Pro a $56 y Max a $117.60 al mes. La facturación anual con descuento y un 10% de descuento en la primera suscripción para cuentas nuevas pueden reducir aún más el coste efectivo de ZCode. Los suscriptores de ZCode también reciben aproximadamente 1.5x de cuota de uso frente a utilizar el mismo plan mediante acceso directo a la API o harnesses de terceros.
El problema es el consumo de tokens de GLM-5.2 durante los bucles de agentes. La cuota del GLM Coding Plan se descuenta a 3x en horas punta y a 2x fuera de ellas. Un usuario de r/ZaiGLM señaló que las asignaciones para MCP y búsquedas web se agotan de forma inusualmente rápida frente a Claude Code, y otro hilo documentó una única tarea de Goal Mode que consumió el 27% de la cuota semanal: aproximadamente 55 millones de tokens. Son testimonios individuales, pero encajan con el mayor consumo de tokens por tarea de GLM-5.2.
Z.ai mantiene una promoción de 1x fuera de horas punta hasta septiembre de 2026, que elimina en la práctica el multiplicador de consumo fuera de ese horario. Para los desarrolladores que puedan trasladar ejecuciones autónomas intensivas a esas franjas, el coste efectivo por token se reduce aproximadamente a la mitad.
La estructura de precios de Anthropic es más predecible: Claude Pro incluye el uso estándar de Claude Code; Max 5x y Max 20x multiplican la asignación; y Dynamic Workflows, las tareas autónomas de larga duración, requieren planes Max, Team o Enterprise.
Autonomía: Goal Mode frente a hooks
Ambas herramientas abordan la idea de «seguir trabajando hasta terminar», pero lo hacen desde extremos opuestos.
El Goal Mode de ZCode es una solución empaquetada. Escribes /goal fix all TypeScript compiler errors y el agente entra en ciclo: intenta aplicar correcciones, ejecuta un paso de verificación independiente y, según el resultado, marca el objetivo como completado o inicia otra ronda. Entre los subcomandos están /goal pause, /goal resume, /goal replace y /goal clear. El mecanismo de verificación no está documentado públicamente, por lo que conviene entenderlo como una comprobación automatizada, no como una puerta de validación demostrada contra una suite de pruebas.
El sistema de hooks de Claude Code ofrece infraestructura componible. Los hooks pueden ser comandos de shell, llamadas HTTP, herramientas MCP, prompts o agentes, y se conectan a 25 puntos del ciclo de vida, entre ellos PreToolUse, PostToolUse, Stop y SubagentStop. Un hook de Stop puede ejecutar tu suite de pruebas e impedir que el agente se detenga hasta que estas pasen, proporcionando una verificación determinista en lugar de confiar en la autoevaluación del modelo.
El modo automático de Claude Code añade otra capa: un clasificador del lado del servidor evalúa las llamadas a herramientas antes de ejecutarlas y bloquea acciones destructivas, intentos de exfiltración de datos y comandos que parezcan impulsados por inyección de prompts. Es una opción voluntaria y requiere modelos recientes de la API de Anthropic. ZCode no cuenta con una capa de seguridad equivalente basada en clasificadores.
Subagentes: mezclar proveedores o profundizar en la jerarquía
Los dos productos admiten subagentes, pero cada uno destaca en un terreno diferente.
Los subagentes de ZCode (en beta desde la v3.2.0, el 29 de junio según la documentación) son de nivel de usuario y solo funcionan en primer plano. Su gran diferencia es la mezcla de proveedores por subagente: uno puede usar GLM-5.2, otro llamar a un modelo de Anthropic y un tercero utilizar DeepSeek, todo dentro de la misma sesión. Desde la v3.7.5, las tareas en espera pueden crear subagentes configurados con modelos personalizados, y cada subagente dispone de su propio ajuste de esfuerzo de razonamiento. Los roles integrados incluyen general-purpose y Explore (solo lectura).
Los subagentes de Claude Code tienen una estructura más madura. Admiten definiciones a nivel de proyecto (.claude/agents/) y de usuario (~/.claude/agents/), se definen como archivos Markdown con frontmatter YAML y pueden anidarse hasta cinco niveles, según la documentación de Claude Code. La ejecución en segundo plano está disponible por defecto desde la v2.1.198. La selección de modelo por agente funciona dentro de la familia Claude: sonnet, opus, haiku, fable o identificadores completos de modelo.
Si tu flujo exige que distintos proveedores colaboren en subtareas diferentes, el enfoque BYOK de ZCode tiene una ventaja clara. Si necesitas cadenas de delegación profundas y definiciones de agentes por proyecto que todo el equipo pueda versionar, Claude Code es más sólido.
Gobernanza de datos y estabilidad
Z.ai opera bajo JINGSHENG HENGXING TECHNOLOGY PTE. LTD., registrada en Singapur, y afirma que el procesamiento de datos de API se realiza en Singapur, según la documentación de Z.ai. El laboratorio responsable del modelo subyacente es Zhipu AI. Las condiciones de privacidad para consumidores de ZCode permiten recopilar conversaciones, archivos, código, comandos de shell y resultados generados, mientras que las condiciones de la API indican que las entradas se procesan en tiempo real y no se almacenan.
Anthropic procesa los datos bajo la legislación estadounidense. El uso comercial de la API y Claude Code bajo condiciones comerciales no se utiliza para entrenamiento de forma predeterminada. Las organizaciones que cumplan los requisitos pueden acceder a Zero Data Retention, aunque los resultados de los clasificadores de seguridad se conservan en cualquier caso.
Los pesos de GLM-5.2 con licencia MIT ofrecen una vía de autoalojamiento que los pesos cerrados de Anthropic no proporcionan. Sin embargo, GLM-5.2 en precisión completa requiere aproximadamente 1.57 TB de VRAM, según la model card de Z.ai, lo que hace que el autoalojamiento práctico sea una opción exclusiva para empresas.
En estabilidad, el rápido ritmo de lanzamientos de ZCode hace que las novedades lleguen pronto, pero también que se rompan cosas. Solo el changelog de la v3.7.5 corrige problemas en la navegación de memoria, el renderizado de la vista previa, la reordenación de mensajes, la reconexión de espacios de trabajo remotos y la persistencia del estado del modelo al cambiar de entorno de ejecución. Un antiguo usuario de Claude Code en r/ZaiGLM informó de fallos persistentes de OAuth y CAPTCHA al iniciar sesión en ZCode; las respuestas de la comunidad sugirieron usar un token de API o OpenCode con el endpoint de Z.ai como alternativa más fiable.
¿Qué harness te conviene usar?
| Si tú... | Elige |
|---|---|
| Prefieres un espacio de trabajo visual de escritorio con archivos, terminal, Git y vista previa en una ventana | ZCode |
| Trabajas principalmente en la terminal o en pipelines de CI | Claude Code |
| Necesitas subagentes de varios proveedores en una misma sesión | ZCode |
| Necesitas anidamiento profundo de subagentes y definiciones de agentes por proyecto | Claude Code |
| Quieres iteración autónoma con la mínima configuración | ZCode (Goal Mode) |
| Necesitas verificación componible mediante hooks y puertas deterministas | Claude Code |
| Te preocupa el coste por token | ZCode / GLM-5.2 |
| Estás sujeto a políticas que restringen proveedores vinculados a China | Claude Code |
| Quieres la economía de GLM-5.2 con el harness de Claude Code | Híbrido: Claude Code + GLM-5.2 vía API |
La vía híbrida consiste en configurar Claude Code para llamar a GLM-5.2 mediante el endpoint compatible con Anthropic de Z.ai, definiendo ANTHROPIC_BASE_URL y ANTHROPIC_AUTH_TOKEN. Así obtienes los hooks, subagentes e integración con CI de Claude Code a los precios por token de GLM-5.2. Para ver el proceso paso a paso, consulta nuestra guía de GLM-5.2 en Claude Code. A cambio, renuncias a Goal Mode, la interfaz de escritorio y los subagentes que mezclan proveedores de ZCode, además de enfrentarte a problemas ocasionales de conectividad cuando la API de Z.ai tiene carga.
¿Puede ZCode sustituir a Claude Code?
ZCode es una alternativa viable para el trabajo diario individual centrado en GUI y tareas acotadas de corto recorrido. Claude Code sigue siendo más potente para flujos integrados con CI, trabajo en equipo y tareas de larga duración, donde Opus 4.8 rinde 2x más en benchmarks sostenidos.
¿Puedo usar GLM-5.2 dentro de Claude Code?
Sí. Configura ANTHROPIC_BASE_URL con el endpoint de Z.ai y ANTHROPIC_AUTH_TOKEN con tu clave de API de Z.ai. El GLM Coding Plan es compatible con más de 20 herramientas de programación, entre ellas Claude Code, por lo que se aplica la cuota de tu suscripción.
¿Es ZCode lo bastante estable para usarlo a diario?
La versión v3.7.5 de ZCode corrigió problemas relevantes en la navegación de memoria, el renderizado de vistas previas y la reconexión de espacios de trabajo remotos, pero el alcance de las correcciones en cada lanzamiento revela una fragilidad activa. Los fallos de OAuth y CAPTCHA reportados en r/ZaiGLM sugieren que la fiabilidad de la autenticación sigue siendo un motivo de preocupación. Si tu flujo de trabajo no puede tolerar interrupciones, mantén Claude Code u OpenCode como alternativa de respaldo.