Risultato riportato da Z.ai
Terminal-Bench 3.0
Z.ai riporta 28.3 vs 4.6 per GLM 5.2 su Terminal-Bench 3.0 — il salto riportato più grande.
GLM 5.3 è il nuovo modello flagship di grandi dimensioni di Zhipu AI (Z.ai): contesto da 1M token, output massimo di 128K e migliori benchmark open-source di coding.
GLM 5.3 è il nuovo modello flagship di grandi dimensioni di Zhipu AI (Z.ai), annunciato ad agosto 2026, costruito sulla base GLM 5.2 con post-addestramento su larga scala a lungo orizzonte.
Il nuovo modello base flagship di Z.ai: finestra di contesto da 1M token, output massimo di 128K e modalità testo in ingresso, testo in uscita.
Usa la base GLM 5.2 e aggiunge decine di volte più post-addestramento a lungo orizzonte su veri cluster di calcolo, storage, documenti e codebase; Z.ai afferma che la sensazione del coding migliora di circa il 50%.
L'API del modello GLM 5.3 arriverà presto, quindi questa pagina separa ciò che Z.ai ha confermato (specifiche e benchmark) da ciò che è ancora in sospeso (ID API, prezzi, pesi e licenza).
Z.ai ha confermato specifiche e benchmark. Accesso API, prezzi e pesi aperti sono ancora in attesa di annuncio.
Confermato da Z.ai
La pagina ufficiale del modello elenca una finestra di contesto da 1M token.
Output massimo ufficiale per risposta.
Modello base testuale; nessun input visivo o multimodale è documentato.
L'abbonamento Z.ai Coding Plan ha distribuito completamente il modello.
Z.ai afferma che l'API del modello sarà attiva a breve e non ha pubblicato una data precisa.
Dettagli ufficiali in sospeso
L'API del flagship precedente costa circa $1.40 in ingresso / $4.40 in uscita per 1M token.
GLM 5.2 è distribuito con licenza MIT su Hugging Face; i nuovi pesi e la licenza non sono ancora pubblicati.
Z.ai non ha pubblicato i totali dei parametri.
L'ID modello dell'API pubblica di glm5.app è `glm-5.3`.
Lo stato è verificato rispetto alle comunicazioni pubbliche di Z.ai ad agosto 2026.
Benchmark / 02
Z.ai riporta grandi miglioramenti nei benchmark, ma un punteggio vale solo per l'harness pubblicato e la data.
Risultato riportato da Z.ai
Z.ai riporta 28.3 vs 4.6 per GLM 5.2 su Terminal-Bench 3.0 — il salto riportato più grande.
Risultato riportato da Z.ai
Z.ai riporta 66.9 vs 46.2 per GLM 5.2 su DeepSWE v1.1, un benchmark di ingegneria a lungo orizzonte.
Risultato riportato da Z.ai
Z.ai riporta 28.5 vs 23.8 per GLM 5.2 su Agents' Last Exam, che copre conoscenza e ragionamento agentici.
Risultato riportato da Z.ai
Z.ai riporta 84.5 su CyberGym, leggermente sopra GPT-5.6 Sol a 83.6.
Funzionalità / 03
Supporta lo stack standard per sviluppatori per lavoro agentico e a lungo orizzonte, con contesto da 1M token per attività su scala di progetto.
Più modalità di pensiero ti permettono di bilanciare profondità di ragionamento e latenza, adattandoti all'attività da svolgere.
Forte supporto per chiamate di strumenti per integrazioni esterne, con la tua applicazione che valida ed esegue ogni azione richiesta.
Risposte in streaming in tempo reale per chat interattive e cicli agentici.
Il caching intelligente ottimizza le conversazioni lunghe e il contesto ripetuto, riducendo i costi nelle sessioni a lungo orizzonte.
JSON e altri formati di output strutturato rendono prevedibile l'integrazione di sistema.
GLM 5.3 può chiamare strumenti e sorgenti dati MCP esterni, estendendo i flussi agentici oltre la chat.
Cronologia del rilascio / 04
Le tappe che hanno portato a GLM 5.3 e ciò che deve ancora arrivare, aggiornate man mano che Z.ai pubblica notizie ufficiali.
GLM 5.2 è stato lanciato per attività a lungo orizzonte con una finestra di contesto da 1M token e controllo del livello di sforzo.
Z.ai ha pubblicato la pagina ufficiale del modello e i risultati dei benchmark, nominandolo il nuovo flagship costruito sulla base GLM 5.2.
L'abbonamento GLM Coding Plan ha distribuito completamente il modello per strumenti di coding come Claude Code, Cline e OpenCode.
Z.ai afferma che l'API è in arrivo. ID modello ufficiale, limiti e prezzi saranno aggiornati qui quando annunciati.
I pesi di GLM 5.3 e i dettagli di licenza dovrebbero seguire il precedente MIT di GLM 5.2 su Hugging Face, in attesa di conferma ufficiale.
Segui il blog di Z.ai, il repository GitHub zai-org e i documenti ufficiali bigmodel per i primi annunci API.
A chi è destinato / 05
Pensato per i team che lavorano su ingegneria a lungo orizzonte, flussi agentici e revisione della sicurezza.
Gli sviluppatori che costruiscono assistenti di coding e flussi IDE beneficiano del riportato miglioramento del 50% nella sensazione del coding e del contesto da 1M token.
I team di agenti usano modalità di pensiero, function calling, streaming e MCP per costruire flussi autonomi di lunga durata.
Mostra forza nella code review white-box e nella scoperta di vulnerabilità (CyberGym 84.5).
I team che lavorano su decine di migliaia di righe e decine di file lo usano per pianificare refactor, correggere bug e consegnare progetti con il minimo accompagnamento.
I team di piattaforma seguono prezzi e limiti API per pianificare i budget per caching del contesto e output strutturato.
Gli auto-hoster tengono d'occhio i pesi aperti per pianificare hardware, quantizzazione e revisione della licenza.
Disponibile oggi nella Chat di glm5.app, con l'API ufficiale del modello attesa a seguire.
Apri la Chat di GLM 5.3 su glm5.app, descrivi problema, vincoli e risultato desiderato, poi affina la risposta con il tuo codice e i tuoi criteri di accettazione.
Per integrazioni oggi, il Coding Plan di Z.ai lo serve già in Claude Code, Cline e OpenCode.
Per usare l'API di glm5.app, utilizza l'ID modello `glm-5.3` con la Base URL compatibile OpenAI `https://glm5.app/api/v1`.
Integration specimen
L'API ufficiale del modello GLM 5.3 arriverà presto da Z.ai. glm5.app espone oggi un endpoint Chat Completions compatibile con OpenAI e l'ID modello ufficiale sarà aggiunto qui quando pubblicato.
Apri la documentazione APIcurl https://glm5.app/api/v1/chat/completions \
-H "Authorization: Bearer $GLM5_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.3",
"messages": [{
"role": "user",
"content": "Plan this refactor and list the rollback steps."
}]
}'Risposte chiare su GLM 5.3: data di rilascio, prezzi, benchmark, Hugging Face, parametri, pesi, coding plan e GLM 5.3 vs 5.2.
GLM 5.3 è il nuovo modello flagship di grandi dimensioni di Z.ai, annunciato ad agosto 2026.
La pagina ufficiale del modello e i benchmark sono arrivati ad agosto 2026.
I prezzi API non sono stati pubblicati. Il flagship precedente costa circa $1.40 in ingresso e $4.40 in uscita per milione di token.
Z.ai riporta Terminal-Bench 3.0 a 28.3 (vs 4.6), DeepSWE v1.1 a 66.9 (vs 46.2), Agents' Last Exam a 28.5 (vs 23.8) e CyberGym a 84.5.
I pesi non sono ancora su Hugging Face.
I conteggi dei parametri non sono pubblicati; la pagina ufficiale elenca contesto da 1M token e output massimo di 128K.
I pesi sono attesi con licenza MIT, seguendo il rilascio precedente su Hugging Face.
Il GLM Coding Plan — l'abbonamento di Z.ai per strumenti di coding AI come Claude Code, Cline e OpenCode — ha distribuito completamente il nuovo modello.
Il nuovo modello mantiene la base precedente con post-addestramento a lungo orizzonte più ampio; la sensazione del coding migliora di circa il 50%.
Start here
Chatta gratis con GLM 5.3 su glm5.app e segui qui l'API ufficiale, i prezzi e le notizie open source.