Sem trocar o modelo-base, a Z.ai elevou o GLM-5.2 de 753 bilhões de parâmetros a um modelo de programação próximo da fronteira. Com pós-treinamento, o resultado no DeepSWE saltou de 46,2 para 66,9. Há, porém, duas ressalvas três dias após o lançamento: ainda não existe uma API cobrada por token, e os pesos do modelo anunciado como "open-weights" ficaram retidos para uma revisão de segurança de duas semanas.
O que é, de fato, o GLM-5.3
Lançado em 14 de agosto de 2026, o GLM-5.3 é o mais novo modelo flagship da Z.ai para engenharia de software de longo prazo e tarefas de agentes. A documentação oficial do modelo confirma o ponto mais incomum deste lançamento: o GLM-5.3 usa exatamente o mesmo modelo-base do GLM-5.2. Todos os avanços anunciados vêm do pós-treinamento em fluxos de engenharia realistas, cobrindo o ciclo completo da tarefa — da identificação do problema à implementação, verificação e entrega.
Na prática, o GLM-5.3 é um modelo irmão, não uma arquitetura sucessora. O GLM-5.2 chegou em meados de junho de 2026 como um modelo Mixture-of-Experts de 753 bilhões de parâmetros, sob licença MIT e com pesos no Hugging Face desde 17 de junho, como a TechTimes noticiou no lançamento.
| Especificação | GLM-5.3 | GLM-5.2 |
|---|---|---|
| Modelo-base | Mesmo MoE de 753B (segundo a Z.ai) | MoE de 753B, licença MIT |
| Janela de contexto | 1M tokens | 1M tokens |
| Saída máxima | 128K tokens | 128K tokens |
| Entrada / saída | Texto / texto | Texto / texto |
| Suporte a ferramentas | Function calling, MCP, saída JSON, cache de contexto, modos de raciocínio | Mesma lista (documentação do GLM-5.2) |
| Pesos | Ainda não publicados — adiados para revisão de segurança | No Hugging Face desde 17 de junho |
| Acesso hoje | Apenas GLM Coding Plan; API "em breve" | Coding Plan + API cobrada por token |
O que os benchmarks mostram — e o que não comprovam
Os números abaixo vêm diretamente da documentação de lançamento da Z.ai. Esta é a tabela completa de antes e depois, usando o GLM-5.2 como referência.
| Benchmark | GLM-5.2 | GLM-5.3 | Variação |
|---|---|---|---|
| Terminal-Bench 3.0 | 4,6 | 28,3 | +23,7 |
| DeepSWE v1.1 | 46,2 | 66,9 | +20,7 |
| Agents' Last Exam | 23,8 | 28,5 | +4,7 |
| ExploitBench | 24,4% | 54,4% | +30,0 p.p. |
O salto de 20,7 pontos no DeepSWE apenas com pós-treinamento foi a alegação que mais circulou no dia do lançamento. Uma análise bastante compartilhada no Reddit tratou o resultado como prova de "quanto potencial ainda pode estar escondido dentro dos maiores modelos-base atuais". A mesma página de lançamento informa 1.769 pontos no GDPval-AA v2, distribuídos em 44 categorias profissionais, posicionando o GLM-5.3 para além da programação pura, e afirma que sua capacidade de programação é "comparável ao Claude Fable 5".
Vale considerar a direção dos resultados como real, mas não sua precisão como comprovada. Os números da página de lançamento foram informados pela própria fornecedora, sem detalhes do harness nem intervalos de confiança. A discussão comunitária sobre benchmarks que os acompanha observa que ainda não há reproduções independentes. A checagem externa mais útil disponível é uma comparação compilada por um usuário no r/ZaiGLM: nela, o GPT-5.6 Luna Max marca 67,2 no DeepSWE v1.1, contra 66,9 do GLM-5.3. A diferença de 0,3 ponto sugere que o GLM-5.3 compete na borda da fronteira em código agêntico, mas não a supera com folga. Para avaliar essa dupla hoje, o GPT-5.6 Luna já pode ser chamado, enquanto o GLM-5.2 continua sendo o flagship da família disponível por API até a chegada da API do 5.3. Ele não substitui o comportamento pós-treinado do GLM-5.3, mas compartilha o mesmo modelo-base.
Por que os pesos ainda não foram liberados
A Z.ai está segurando os pesos do GLM-5.3 por cerca de duas semanas enquanto reforça seus controles de segurança, segundo uma reportagem da Axios publicada no dia do lançamento. O motivo é o desempenho do modelo em cibersegurança, que a própria Z.ai descreve como tendo "superado as expectativas" à medida que ampliou seu ambiente de tarefas de longo prazo.
No CyberGym, benchmark voltado à descoberta de vulnerabilidades de segurança conhecidas, o GLM-5.3 alcançou 84,5% — à frente do Mythos 5, com 83,8%, e do GPT-5.6 Sol, com 83,6%, na tabela comparativa da Z.ai. Já no ExploitBench, que avalia o raciocínio em desenvolvimento real de exploits, os 54,4% do GLM-5.3 mais que dobraram os 24,4% do GLM-5.2, mas ainda ficaram atrás de Claude Fable 5 e GPT-5.6 Sol na leitura dos resultados feita pela Axios. A documentação da Z.ai é direta sobre a limitação: a vantagem se concentra no começo da cadeia de exploração, e explorações mais profundas, além de fluxos ofensivos e defensivos completos, "precisam melhorar".
Dois fatos ajudam a contextualizar o adiamento:
- Segundo a Axios, a Z.ai lançou no mesmo dia um site de divulgação que atribui aos seus modelos GLM a descoberta de mais de 2.400 falhas de segurança — mais de 1.000 delas críticas ou de alta severidade — em alvos que incluem o kernel Linux, projetos VMware e projetos Apache. Mantenedores de código aberto podem enviar repositórios para varreduras de bugs feitas com GLM.
- De acordo com a Axios, em vez de liberar os pesos publicamente, a Z.ai está montando um programa em níveis para oferecer a parceiros de segurança selecionados acesso controlado durante a janela de revisão. É uma via separada do Coding Plan.
Quando os pesos se tornarem públicos, a Z.ai perde a capacidade de controlar modificações feitas posteriormente. O anúncio da própria empresa resumiu o risco assim: "Um mundo aberto não pode ter apenas superfícies de ataque abertas."
Como acessar o GLM-5.3 hoje
No momento, o público só consegue acessar o GLM-5.3 por meio de uma assinatura do GLM Coding Plan. A documentação oficial diz que a API chega "em breve", e o GLM-5.3 não aparece na tabela de preços por token da Z.ai em 17 de agosto de 2026. GLM-5.2, GLM-5.1 e GLM-5 têm preços listados, o que indica que a linha do 5.3 simplesmente ainda não foi ativada.
As faixas de assinatura da página oficial de planos:
| Plano | Preço de tabela | Preço exibido | Franquia | Carga de trabalho indicada |
|---|---|---|---|---|
| Lite | US$ 18/mês | US$ 12,60/mês | 10.000 créditos/semana | Repositórios pequenos, iteração leve |
| Pro | US$ 80/mês | US$ 56/mês | 6× o uso do Lite | Desenvolvimento diário, repositórios médios |
| Max | US$ 168/mês | US$ 117,60/mês | 14× o uso do Lite | Repositórios médios a grandes, agentes intensivos |
Os preços exibidos aparecem ao lado de valores de referência mais altos, sem uma condição de cobrança identificada. Considere US$ 18/US$ 80/US$ 168 como os valores mensais de referência, e os preços menores como o desconto atual. A configuração exige um único comando, npx @z_ai/coding-helper, que conecta o plano à ferramenta de sua preferência. A Z.ai lista mais de 20 ferramentas de agentes compatíveis, incluindo Claude Code, OpenClaw e seu próprio ZCode, com acesso a ferramentas MCP a partir do plano Pro. O Max promete acesso prioritário a novos flagships, e todos os níveis do Coding Plan recebem acesso rotativo ao modelo flagship atual.
A mudança de preço que veio junto com o lançamento
O Coding Plan teve seus preços reajustados em torno do lançamento do GLM-5.3, e usuários intensivos perceberam isso imediatamente. Um assinante que acompanhou os números no r/ZaiGLM publicou a comparação abaixo, relatada por assinante, com os antigos planos V2. Trate os dados como informação da comunidade, não como uma tabela oficial da Z.ai, e confira seu próprio painel antes de tomar uma decisão.
| Plano | Preço antigo | Tokens antigos/semana | Novo preço | Novos tokens/semana |
|---|---|---|---|---|
| Pro | US$ 65 | ~500M | US$ 80 | ~526M |
| Max | US$ 144 | ~2B | US$ 168 | ~1,22B |
"o novo Max dá ~39% menos tokens enquanto custa ~17% mais." - u/x-primez-x, r/ZaiGLM
Pela conta do autor da publicação, isso equivale a um custo por token cerca de 1,9× pior no plano Max: aproximadamente 7,26M tokens por dólar por semana, ante ~13,89M. O impacto no Pro é menor: cerca de 5% mais franquia por aproximadamente 23% mais dinheiro, ou aproximadamente 14% menos tokens por dólar pela mesma conta. A mesma publicação elogia bastante o modelo, mas traz um alerta:
"O GLM-5.3 parece incrível… mas esse novo coding plan provavelmente vai me afastar da Z.AI de vez." - u/x-primez-x, r/ZaiGLM
Como referência para a futura API: quando surgir o preço por token do GLM-5.3, o ponto de partida da família é o GLM-5.2, que custa US$ 1,40 por 1M de tokens de entrada, US$ 0,26 para entrada em cache e US$ 4,40 na saída, segundo a página oficial de preços. O armazenamento de entrada em cache está atualmente gratuito. Um comentarista da mesma discussão já defende que, no embate assinatura versus API, o modelo pay-as-you-go leva vantagem: "A flexibilidade vale a pena quando novos modelos saem toda semana ou a cada duas semanas."
Vale migrar para o GLM-5.3?
A resposta mais honesta depende do que você usa hoje:
| Seu perfil | Migrar agora? | Motivo |
|---|---|---|
| Assinante do Coding Plan Pro | Sim | Mesmo plano de US$ 80, com acesso imediato ao GLM-5.3; o salto no DeepSWE foi informado pela fornecedora, então valide primeiro no seu próprio repositório |
| Usuário intensivo do Coding Plan Max | Faça as contas antes | ~39% menos tokens semanais que o antigo Max por um preço maior; o throughput por dólar pode ter caído abaixo do seu ponto de equilíbrio |
| Usuário de API pay-as-you-go | Espere | Ainda não há preço por token; o GLM-5.2, a US$ 1,40/US$ 4,40 por 1M, segue como o único flagship GLM que pode ser medido por consumo |
| Quem roda localmente | Espere pelos pesos | Não há nada para executar até o fim da revisão de ~duas semanas; a mesma base MoE de 753B exige hardware de servidor com múltiplas GPUs, e o suporte a vLLM/SGLang é uma expectativa derivada dessa base compartilhada, não uma confirmação da Z.ai |
| Usuário dependente de visão | Não | O GLM-5.3 é texto para texto, assim como o GLM-5.2; visão continua na linha separada e fechada GLM-5V |
A última linha merece destaque porque foi o pedido mais forte da comunidade antes do lançamento. A enquete de 29 de junho de Jie Tang, perguntando o que o GLM-5.3 deveria incluir, recebeu 466.000 visualizações, com visão como resposta amplamente dominante. Mesmo assim, o modelo lançado continua sem encoder visual. Se seu fluxo recebe capturas de tela, PDFs ou mockups de interface, o contorno é o GLM-5V-Turbo, a US$ 1,20/US$ 4,00 por 1M tokens, via API da Z.ai — não o GLM-5.3.
O ponto em aberto é o seguinte: assinar agora garante acesso imediato ao GLM-5.3, mas prende você a cotas reajustadas; esperar não custa nada além do acesso. Os pesos têm o prazo de revisão declarado pela Z.ai. Já a API traz apenas o rótulo "em breve", sem preço nem data. Se seu gargalo hoje não é o throughput de programação agêntica, a janela de duas semanas para os pesos é curta o bastante para esperar.
Perguntas frequentes
Quando os pesos do GLM-5.3 serão liberados?
A Z.ai adiou a liberação dos pesos em cerca de duas semanas a partir do lançamento de 14 de agosto, para uma revisão de segurança. Se o cronograma for mantido, isso aponta para o fim de agosto. Vale acompanhar a organização zai-org no Hugging Face: foi lá que os pesos do GLM-5.2 apareceram poucos dias após seu lançamento em junho.
O GLM-5.3 é open source?
O GLM-5.3 é posicionado como um modelo open-weights, mas os pesos ainda não foram publicados e a documentação de lançamento não informa uma licença. O GLM-5.2 foi lançado sob MIT, o que sustenta a expectativa da comunidade de que o GLM-5.3 siga a mesma licença — mas isso é uma suposição, não um compromisso da Z.ai.
O GLM-5.3 aceita imagens ou oferece visão?
Não. A documentação oficial lista somente entrada e saída de texto, com contexto de 1M tokens e saída máxima de 128K tokens. A visão nativa continua na família separada GLM-5V, composta por GLM-5V-Turbo e GLM-4.6V, disponibilizada pela Z.ai via API, não por pesos abertos.
Quanto custa o GLM-5.3 por token?
Ainda não há preço por token. A API está listada como "em breve" e o GLM-5.3 não consta na tabela de preços da Z.ai. Hoje, o único acesso é pelo GLM Coding Plan, com preços de tabela de US$ 18/US$ 80/US$ 168 por mês, exibidos atualmente como US$ 12,60/US$ 56/US$ 117,60.
É possível rodar o GLM-5.3 localmente?
Ainda não, até que os pesos sejam liberados. O GLM-5.2 chegou com suporte no model card para vLLM, SGLang e KTransformers (segundo a TechTimes); a documentação de lançamento ainda não fala nada sobre a stack de implantação do GLM-5.3. Portanto, planeje hardware de servidor com múltiplas GPUs, não máquinas de consumo.