Resultado relatado pela Z.ai
Terminal-Bench 3.0
A Z.ai relata 28.3 vs 4.6 para o GLM 5.2 no Terminal-Bench 3.0 — o maior salto relatado.
O o modelo é o novo grande modelo de linguagem principal da Zhipu AI (Z.ai): contexto de 1M-token, saída máxima de 128K e os melhores benchmarks de codificação de código aberto.
O GLM 5.3 é o novo grande modelo de linguagem principal da Zhipu AI (Z.ai), anunciado em agosto de 2026, construído sobre a base do GLM 5.2 com pós-treinamento de longo prazo em larga escala.
O mais novo modelo principal da Z.ai: janela de contexto de 1M-token, saída máxima de 128K e modalidade texto-in, texto-out.
Ele usa a base do GLM 5.2 e adiciona dezenas de vezes mais pós-treinamento de longo prazo em clusters de computação reais, armazenamento, documentos e bases de código; a Z.ai afirma que a sensação de codificação melhora cerca de 50%.
A API do modelo GLM 5.3 chega em breve; portanto, esta página separa o que a Z.ai confirmou (especificações e benchmarks) do que ainda está pendente (ID da API, preços, pesos e licença).
A Z.ai confirmou as especificações e os benchmarks.
Confirmado pela Z.ai
A página oficial do modelo lista uma janela de contexto de 1M-token.
Saída máxima oficial em tokens por resposta.
Modelo base de texto; não há entrada multimodal ou de visão documentada.
A assinatura do Z.ai Coding Plan já distribuiu totalmente o modelo.
A Z.ai afirma que a API do modelo será lançada em breve e não publicou uma data definitiva.
Detalhes oficiais pendentes
A API do modelo principal anterior custa cerca de $1.40 de entrada / $4.40 de saída por 1M de tokens.
O GLM 5.2 é distribuído sob a licença MIT no Hugging Face; os novos pesos e a licença ainda não foram publicados.
A Z.ai não publicou os totais de parâmetros.
O ID de modelo da API pública do glm5.app é `glm-5.3`.
O status é verificado em relação às comunicações públicas da Z.ai até agosto de 2026.
Benchmarks / 02
A Z.ai relata grandes ganhos de benchmark, mas uma pontuação só se aplica ao harness e à data publicados.
Resultado relatado pela Z.ai
A Z.ai relata 28.3 vs 4.6 para o GLM 5.2 no Terminal-Bench 3.0 — o maior salto relatado.
Resultado relatado pela Z.ai
A Z.ai relata 66.9 vs 46.2 para o GLM 5.2 no DeepSWE v1.1, um benchmark de engenharia de longo prazo.
Resultado relatado pela Z.ai
A Z.ai relata 28.5 vs 23.8 para o GLM 5.2 no Agents' Last Exam, que cobre conhecimento e raciocínio agêntico.
Resultado relatado pela Z.ai
A Z.ai relata 84.5 no CyberGym, ligeiramente acima do GPT-5.6 Sol com 83.6 — um resultado publicado, não uma garantia para o seu fluxo de trabalho de segurança.
Recursos / 03
Ele suporta o stack de desenvolvimento padrão para trabalho agêntico e de longo prazo, com contexto de 1M-token para tarefas na escala de projetos.
Vários modos de raciocínio permitem equilibrar profundidade de raciocínio e latência, ajustando-se à tarefa em questão.
Suporte forte a chamadas de ferramentas para integrações externas, com seu aplicativo validando e executando cada ação solicitada.
Respostas em streaming em tempo real para chat interativo e loops de agentes.
O cache inteligente otimiza conversas longas e contextos repetidos, reduzindo custos em sessões de longo prazo.
Formatos de saída estruturada, como JSON, tornam a integração de sistemas previsível.
O GLM 5.3 pode chamar ferramentas e fontes de dados MCP externas, ampliando os fluxos de trabalho de agentes além do chat.
Linha do tempo do lançamento / 04
Os marcos que levaram ao GLM 5.3 e o que ainda precisa ser lançado, atualizados conforme a Z.ai publica notícias oficiais.
O GLM 5.2 foi lançado para tarefas de longo prazo com uma janela de contexto de 1M-token e controle de nível de esforço.
A Z.ai publicou a página oficial do modelo e os resultados de benchmark, nomeando-o como o novo modelo principal construído sobre a base do GLM 5.2.
A assinatura do GLM Coding Plan distribuiu totalmente o modelo para ferramentas de codificação como Claude Code, Cline e OpenCode.
A Z.ai afirma que a API chega em breve. O ID oficial do modelo, os limites e os preços serão atualizados aqui quando anunciados.
Espera-se que os pesos e os detalhes da licença do GLM 5.3 sigam o precedente MIT do GLM 5.2 no Hugging Face, sujeito à confirmação oficial.
Siga o blog da Z.ai, o repositório GitHub zai-org e os docs oficiais do bigmodel para os primeiros anúncios da API.
Para quem é / 05
Voltado para equipes que trabalham com engenharia de longo prazo, fluxos de trabalho agênticos e revisão de segurança.
Desenvolvedores que constroem assistentes de codificação e fluxos de trabalho em IDE se beneficiam do ganho relatado de 50% na sensação de codificação e do contexto de 1M-token para trabalho em repositórios inteiros.
Equipes de agentes usam modos de raciocínio, function calling, streaming e MCP para construir fluxos de trabalho autônomos de longa duração com condições de parada claras.
Ele mostra força em revisão de código white-box e descoberta de vulnerabilidades (CyberGym 84.5), útil como uma camada de assistência que especialistas ainda validam.
Equipes que trabalham em dezenas de milhares de linhas e dezenas de arquivos o usam para planejar refatorações, corrigir bugs e entregar projetos com o mínimo de supervisão.
Equipes de plataforma acompanham o preço e os limites da API para planejar orçamento de cache de contexto e saída estruturada antes de a API oficial entrar no ar.
Quem opera self-hosted fica de olho nos pesos abertos no Hugging Face para planejar hardware, quantização e revisão de licença, seguindo o precedente MIT anterior.
Disponível hoje no Chat do glm5.app, com a API oficial do modelo esperada em seguida.
Abra o Chat do GLM 5.3 no glm5.app, descreva o problema, as restrições e o resultado desejado e refine a resposta com seu próprio código e critérios de aceite.
Para integrações com ferramentas de codificação hoje, o Z.ai Coding Plan já o oferece em ferramentas como Claude Code, Cline e OpenCode.
Para usar a API do glm5.app, utilize o ID de modelo `glm-5.3` com a Base URL compatível com OpenAI `https://glm5.app/api/v1`.
Integration specimen
A API oficial do modelo GLM 5.3 chega em breve pela Z.ai. O glm5.app expõe hoje um endpoint de Chat Completions compatível com OpenAI, e o ID oficial do modelo será adicionado aqui quando publicado.
Abrir documentação da APIcurl https://glm5.app/api/v1/chat/completions \
-H "Authorization: Bearer $GLM5_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.3",
"messages": [{
"role": "user",
"content": "Plan this refactor and list the rollback steps."
}]
}'Respostas claras sobre o GLM 5.3: data de lançamento, preços, benchmarks, Hugging Face, parâmetros, pesos, coding plan e GLM 5.3 vs 5.2.
A página oficial do modelo e os benchmarks chegaram em agosto de 2026.
O preço da API não foi publicado. Para referência, o modelo principal anterior custa cerca de $1.40 de entrada e $4.40 de saída por milhão de tokens.
As contagens de parâmetros não foram publicadas; a página oficial lista contexto de 1M-token e saída máxima de 128K.
Espera-se que os pesos estejam sob a licença MIT, seguindo o lançamento anterior no Hugging Face.
O GLM Coding Plan — a assinatura da Z.ai para ferramentas de codificação com IA como Claude Code, Cline e OpenCode — já distribuiu totalmente o novo modelo.
Sim — glm5.3, GLM-5.3 e GLM 5.3 são variantes ortográficas do mesmo modelo.
Start here
Converse com o GLM 5.3 gratuitamente no glm5.app e acompanhe aqui a API oficial, os preços e as novidades de código aberto.