Door Z.ai gerapporteerd resultaat
Terminal-Bench 3.0
Z.ai rapporteert 28.3 tegen 4.6 voor GLM 5.2 op Terminal-Bench 3.0 — de grootste gerapporteerde sprong.
GLM 5.3 is het nieuwe vlaggenschip-grote-taalmodel van Zhipu AI (Z.ai): 1M tokens context, 128K maximale output en toonaangevende open-source-codeerbenchmarks. Chat gratis met GLM 5.3 op glm5.app en volg hier het prijsnieuws en open-source-nieuws.
GLM 5.3 is het nieuwe vlaggenschip-grote-taalmodel van Zhipu AI (Z.ai), aangekondigd in augustus 2026, gebouwd op de GLM 5.2-basis met grootschalige long-horizon post-training.
Het nieuwste vlaggenschip-basismodel van Z.ai: contextvenster van 1M tokens, maximale output van 128K en tekst-in, tekst-uit-modaliteit.
Het gebruikt de GLM 5.2-basis en voegt tientallen keren meer long-horizon post-training toe over echte compute-clusters, opslag, documentatie en codebases; Z.ai zegt dat het codeergevoel met ongeveer 50% verbetert.
De GLM 5.3-model-API komt binnenkort, dus deze pagina scheidt wat Z.ai heeft bevestigd (specificaties en benchmarks) van wat nog openstaat (API-ID, prijzen, gewichten en licentie).
Z.ai heeft de specificaties en benchmarks bevestigd. API-toegang, prijzen en open gewichten wachten nog op aankondigingen.
Bevestigd door Z.ai
De officiële modelpagina vermeldt een contextvenster van 1M tokens.
Officiële maximale output in tokens per antwoord.
Tekstbasismodel; geen visuele of multimodale input is gedocumenteerd.
Het Z.ai Coding Plan-abonnement heeft het model volledig uitgerold.
Z.ai zegt dat de model-API binnenkort live gaat en heeft geen vaste datum gepubliceerd.
Openstaande officiële details
De API van het vorige vlaggenschip kost ongeveer $1.40 input / $4.40 output per 1M tokens.
GLM 5.2 wordt onder MIT uitgebracht op Hugging Face; de nieuwe gewichten en licentie zijn nog niet gepubliceerd.
Z.ai heeft geen totalen van parameters gepubliceerd.
De publieke API-model-ID op glm5.app is `glm-5.3`.
De status is gecontroleerd aan de hand van de publieke communicatie van Z.ai per augustus 2026. Details die niet als bevestigd zijn gemarkeerd, moeten als niet-geverifieerd worden behandeld totdat Z.ai ze aankondigt.
Benchmarks / 02
Z.ai rapporteert grote benchmarkwinsten, maar een score geldt alleen voor de gepubliceerde harness en datum. Reproduceer een taak die lijkt op je eigen workflow voordat je beslist.
Door Z.ai gerapporteerd resultaat
Z.ai rapporteert 28.3 tegen 4.6 voor GLM 5.2 op Terminal-Bench 3.0 — de grootste gerapporteerde sprong.
Door Z.ai gerapporteerd resultaat
Z.ai rapporteert 66.9 tegen 46.2 voor GLM 5.2 op DeepSWE v1.1, een long-horizon engineeringbenchmark.
Door Z.ai gerapporteerd resultaat
Z.ai rapporteert 28.5 tegen 23.8 voor GLM 5.2 op Agents' Last Exam, dat agentische kennis en redeneren omvat.
Door Z.ai gerapporteerd resultaat
Z.ai rapporteert 84.5 op CyberGym, iets boven GPT-5.6 Sol met 83.6 — een gepubliceerd resultaat, geen garantie voor jouw beveiligingsworkflow.
Mogelijkheden / 03
Het ondersteunt de standaard developerstack voor agentisch en long-horizon werk, met 1M tokens context voor taken op projectniveau.
Meerdere denkmodi laten je de diepte van het redeneren afwegen tegen de latentie, afgestemd op de taak.
Sterke ondersteuning voor tool-aanroepen voor externe integraties, waarbij jouw applicatie elke aangevraagde actie valideert en uitvoert.
Realtime streaming-antwoorden voor interactieve chat en agent-loops.
Slimme caching optimaliseert lange gesprekken en herhaalde context en verlaagt de kosten bij long-horizon sessies.
JSON en andere gestructureerde outputformaten maken systeemintegratie voorspelbaar.
GLM 5.3 kan externe MCP-tools en databronnen aanroepen, waardoor agentworkflows verder reiken dan chat.
Release-tijdlijn / 04
De mijlpalen die naar GLM 5.3 leidden en wat er nog moet verschijnen, bijgewerkt zodra Z.ai officieel nieuws publiceert.
GLM 5.2 werd gelanceerd voor long-horizon taken met een contextvenster van 1M tokens en effort-level controle.
Z.ai publiceerde de officiële modelpagina en benchmarkresultaten en noemde het het nieuwe vlaggenschip dat op de GLM 5.2-basis is gebouwd.
Het GLM Coding Plan-abonnement rolde het model volledig uit voor codeertools zoals Claude Code, Cline en OpenCode.
Z.ai zegt dat de API binnenkort komt. De officiële model-ID, limieten en prijzen worden hier bijgewerkt zodra ze zijn aangekondigd.
Van GLM 5.3 wordt verwacht dat de gewichten en licentiedetails het MIT-precedent van GLM 5.2 op Hugging Face volgen, in afwachting van officiële bevestiging.
Volg de Z.ai-blog, de zai-org GitHub-repository en de officiële bigmodel-documentatie voor de eerste API-aankondigingen.
Voor wie / 05
Gericht op teams die aan long-horizon engineering, agentische workflows en beveiligingsbeoordeling doen.
Ontwikkelaars die codeerassistenten en IDE-workflows bouwen profiteren van de gerapporteerde 50% verbetering van het codeergevoel en de 1M-token context voor werk in een hele repository.
Agent-teams gebruiken denkmodi, function calling, streaming en MCP om langlopende autonome workflows met duidelijke stopcondities te bouwen.
Het toont kracht in white-box code review en het vinden van kwetsbaarheden (CyberGym 84.5), nuttig als assistentlaag die experts nog steeds valideren.
Teams die over tienduizenden regels en tientallen bestanden werken, gebruiken het om refactors te plannen, bugs te verhelpen en projecten op te leveren met minimale begeleiding.
Platformteams volgen API-prijzen en -limieten om te budgetteren voor context caching en gestructureerde output voordat de officiële API live gaat.
Self-hosters houden open gewichten op Hugging Face in de gaten om hardware, kwantisering en licentiereview te plannen, in navolging van het eerdere MIT-precedent.
Vandaag al beschikbaar in glm5.app Chat; de officiële model-API volgt naar verwachting.
Open GLM 5.3 Chat op glm5.app, beschrijf het probleem, de randvoorwaarden en het gewenste resultaat en verfijn daarna het antwoord met je eigen code en acceptatiecriteria.
Voor codeertool-integraties van vandaag levert het Z.ai Coding Plan het al in tools zoals Claude Code, Cline en OpenCode.
Voor toegang tot de glm5.app API gebruik je model-ID `glm-5.3` met de OpenAI-compatibele Base URL `https://glm5.app/api/v1`.
Integration specimen
De officiële GLM 5.3-model-API van Z.ai komt binnenkort. glm5.app biedt vandaag al een OpenAI-compatibel Chat Completions-endpoint aan en de officiële model-ID wordt hier toegevoegd zodra die gepubliceerd is. Bewaar API-sleutels op de server, begin met een smal verzoek en leg de verwachte vorm van het antwoord vast voordat je opschaalt.
Open de API-documentatiecurl https://glm5.app/api/v1/chat/completions \
-H "Authorization: Bearer $GLM5_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.3",
"messages": [{
"role": "user",
"content": "Plan this refactor and list the rollback steps."
}]
}'Duidelijke GLM 5.3-antwoorden over de releasedatum, prijzen, benchmarks, Hugging Face, parameters, gewichten, het coding plan en GLM 5.3 versus 5.2.
GLM 5.3 is het nieuwe vlaggenschip-grote-taalmodel van Z.ai, aangekondigd in augustus 2026. Het behoudt de GLM 5.2-basis met veel uitgebreidere long-horizon post-training en een context van 1M tokens.
De officiële modelpagina en benchmarks verschenen in augustus 2026. Het GLM Coding Plan levert het al en de model-API gaat naar verwachting binnenkort live.
De API-prijzen zijn niet gepubliceerd. Ter referentie: het vorige vlaggenschip kost ongeveer $1.40 input en $4.40 output per miljoen tokens. glm5.app biedt gratis chat-credits en de prijzen worden hier bijgewerkt zodra ze zijn aangekondigd.
Z.ai rapporteert Terminal-Bench 3.0 met 28.3 (tegen 4.6), DeepSWE v1.1 met 66.9 (tegen 46.2), Agents' Last Exam met 28.5 (tegen 23.8) en CyberGym met 84.5, allemaal tegen het vorige model. Scores gelden alleen voor de gepubliceerde harness.
De gewichten staan nog niet op Hugging Face. Z.ai bracht het vorige model als open source uit onder de MIT-licentie, dus een release daar wordt algemeen verwacht, maar is per augustus 2026 nog niet gepubliceerd.
Het aantal parameters is niet gepubliceerd; de officiële pagina vermeldt 1M tokens context en 128K maximale output. Totalen volgen waarschijnlijk de MoE-architectuur van de GLM 5-familie.
De gewichten worden verwacht onder de MIT-licentie, in navolging van de vorige release op Hugging Face. Z.ai heeft de licentie nog niet bevestigd, dus behandel details over open gewichten als onbevestigd.
Het GLM Coding Plan — het Z.ai-abonnement voor AI-codeertools zoals Claude Code, Cline en OpenCode — heeft het nieuwe model volledig uitgerold. Het is een abonnement, geen open API.
Het nieuwe model behoudt de vorige basis met veel uitgebreidere long-horizon post-training; het codeergevoel verbetert met ongeveer 50%. Winsten: Terminal-Bench 3.0 van 4.6 naar 28.3, DeepSWE v1.1 van 46.2 naar 66.9, plus white-box code review.
Chat vandaag gratis met GLM 5.3 in glm5.app Chat; het GLM Coding Plan levert het ook. De publieke model-API gaat naar verwachting binnenkort live en deze pagina wordt bijgewerkt met de officiële ID en limieten zodra ze zijn aangekondigd.
Ja — glm5.3, GLM-5.3 en GLM 5.3 zijn spellingsvarianten van hetzelfde model. Gebruik in de publieke API van glm5.app `glm-5.3` als model-ID.
Start here
Chat gratis met GLM 5.3 op glm5.app en volg hier het officiële API-, prijs- en open-source-nieuws.