Resultat rapporteret af Z.ai
Terminal-Bench 3.0
Z.ai rapporterer 28.3 vs. 4.6 for den forrige flagskibsmodel på Terminal-Bench 3.0 – det største rapporterede spring.
GLM 5.3 er den nye flagskibs-store-sprogmodel fra Zhipu AI (Z.ai): 1M-token kontekst, 128K maksimal output og topresultater på open source-kodnings-benchmarks. Chat med modellen gratis på glm5.app.
GLM 5.3 er den nye flagskibsmodel fra Zhipu AI (Z.ai), annonceret i august 2026, bygget på forrige generations base med storstilet langhorisont-posttræning.
Den er Z.ai's nyeste flagskibs-basismodel: 1M-token kontekstvindue, 128K maksimal output og tekst-til-tekst-modalitet.
Den bruger den forrige flagskibsbasis og tilføjer mangedobbelt mere langhorisont-posttræning på rigtige computerklynger, lagring, dokumenter og kodebaser; Z.ai siger, at kodningsoplevelsen forbedres med omkring 50%.
model-API'en kommer snart, så denne side adskiller, hvad Z.ai har bekræftet (specifikationer og benchmarks), fra det, der stadig er på vej (API-ID, priser, vægte og licens).
Z.ai har bekræftet specifikationer og benchmarks. API-adgang, priser og åbne vægte afventer stadig annonceringer.
Bekræftet af Z.ai
Den officielle modelside angiver et kontekstvindue på 1M-token.
Officiel maksimal output-tokens pr. svar.
Tekstbasismodel; ingen vision- eller multimodal input er dokumenteret.
Z.ai Coding Plan-abonnementet har rullet modellen fuldt ud.
Z.ai siger, at model-API'en går live inden længe, men har ikke offentliggjort en fast dato.
Ventende officielle detaljer
Den tidligere flagskibs-API koster omkring $1.40 input / $4.40 output pr. 1M tokens.
Den forrige flagskibsmodel udgives under MIT på Hugging Face; de nye vægte og licensen er ikke offentliggjort endnu.
Z.ai har ikke offentliggjort parametertotaler.
Det offentlige API-model-ID på glm5.app er `glm-5.3`.
Status er tjekket mod Z.ai's offentlige kommunikation pr. august 2026; ubekræftede detaljer bør behandles som uverificerede, indtil Z.ai annoncerer dem.
Benchmarks / 02
Z.ai rapporterer store benchmark-forbedringer, men en score gælder kun for den offentliggjorte testopsætning og dato. Reproducér en lignende opgave, før du beslutter dig.
Resultat rapporteret af Z.ai
Z.ai rapporterer 28.3 vs. 4.6 for den forrige flagskibsmodel på Terminal-Bench 3.0 – det største rapporterede spring.
Resultat rapporteret af Z.ai
Z.ai rapporterer 66.9 vs. 46.2 for den forrige flagskibsmodel på DeepSWE v1.1, et langhorisont-engineeringbenchmark.
Resultat rapporteret af Z.ai
Z.ai rapporterer 28.5 vs. 23.8 for den forrige flagskibsmodel på Agents' Last Exam, der dækker agentisk viden og ræsonnering.
Resultat rapporteret af Z.ai
Z.ai rapporterer 84.5 på CyberGym, lidt over GPT-5.6 Sol med 83.6.
Kapaciteter / 03
Den understøtter den standard developer-stak til agentisk og langhorisont-arbejde, med 1M-token kontekst til projektskalerede opgaver.
Flere tanketilstande lader dig balancere ræsonneringsdybde mod latens, så det matcher den opgave, du står med.
Stærk værktøjskalds-understøttelse til eksterne integrationer, hvor din applikation validerer og udfører hver anmodet handling.
Realtids-streaming-svar til interaktiv chat og agentloops.
Smart caching optimerer lange samtaler og gentaget kontekst og skærer omkostningerne ned på langhorisont-sessioner.
JSON og andre strukturerede outputformater gør systemintegration forudsigelig.
Den kan kalde eksterne MCP-værktøjer og datakilder og udvide agentarbejdsgange ud over chat.
Udgivelsestidslinje / 04
De milepæle, der førte til modellen, og hvad der stadig mangler at lande – opdateret, efterhånden som Z.ai offentliggør nyheder.
GLM 5.2 blev lanceret til langhorisont-opgaver med et 1M-token kontekstvindue og indsatsniveau-kontrol.
Z.ai offentliggjorde den officielle modelside og benchmarkresultaterne og kaldte den det nye flagskib bygget på forrige generations base.
GLM Coding Plan-abonnementet rullede modellen fuldt ud til kodningsværktøjer som Claude Code, Cline og OpenCode.
Z.ai siger, at API'en kommer snart. Det officielle model-ID, grænser og priser opdateres her, når de annonceres.
vægte og licensdetaljer forventes at følge forgængerens MIT-præcedens på Hugging Face, afventende officiel bekræftelse.
Følg Z.ai-bloggen, zai-org GitHub-repository'et og de officielle bigmodel-dokumenter for de første API-annonceringer.
Hvem det er til / 05
Rettet mod teams, der arbejder med langhorisont-engineering, agentiske arbejdsgange og sikkerhedsgennemgang.
Udviklere, der bygger kodningsassistenter og IDE-arbejdsgange, drager fordel af modellens rapporterede 50% forbedring i kodningsoplevelse og 1M-token konteksten til helt-repository-arbejde.
Agentteams bruger modellens tanketilstande, funktionskald, streaming og MCP til at bygge langvarige autonome arbejdsgange med tydelige stopbetingelser.
Den viser styrke i white-box-kodegennemgang og sårbarhedsopdagelse (CyberGym 84.5), nyttig som et assistentlag, som eksperter stadig validerer.
Teams, der arbejder på tværs af titusindvis af linjer og snesevis af filer, bruger den til at planlægge refaktoreringer, rette bugs og levere projekter med minimal vejledning.
Platformteams følger modellens API-priser og -grænser for at budgettere med kontekst-caching og struktureret output, før den officielle API går live.
Self-hostere holder øje for modellen's åbne vægte på Hugging Face for at planlægge hardware, kvantisering og licensgennemgang efter den tidligere MIT-præcedens.
Tilgængelig i glm5.app Chat i dag, og den officielle model-API forventes at følge efter.
Åbn GLM 5.3 Chat på glm5.app, beskriv problemet og det ønskede resultat, og forfin svaret med din egen kode og acceptkriterier.
Til kodningsværktøjs-integrationer i dag serverer Z.ai Coding Plan allerede modellen i værktøjer som Claude Code, Cline og OpenCode.
Til glm5.app API-adgang skal du bruge model-ID'et `glm-5.3` med den OpenAI-kompatible base-URL `https://glm5.app/api/v1`.
Integration specimen
Den officielle GLM 5.3-model-API kommer snart fra Z.ai. glm5.app tilbyder i dag et OpenAI-kompatibelt Chat Completions-endpoint, og det officielle model-ID tilføjes her, når det offentliggøres. Behold API-nøglerne på serveren, og skaler gradvist fra små anmodninger.
Åbn API-dokumentationcurl https://glm5.app/api/v1/chat/completions \
-H "Authorization: Bearer $GLM5_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.3",
"messages": [{
"role": "user",
"content": "Plan this refactor and list the rollback steps."
}]
}'Tydelige GLM 5.3-svar om udgivelsesdato, priser, benchmarks, Hugging Face, parametre, vægte, Coding Plan og GLM 5.3 vs. 5.2.
Det er Z.ai's nye flagskibs-store-sprogmodel, annonceret i august 2026. Den beholder GLM 5.2-basen med markant større langhorisont-posttræning og en 1M-token kontekst.
Den officielle modelside og benchmarks kom i august 2026. GLM Coding Plan serverer allerede modellen.
API-priserne er ikke offentliggjort. Til sammenligning koster det tidligere flagskib omkring $1.40 input og $4.40 output pr. million tokens. glm5.app tilbyder gratis chat-credits.
Z.ai rapporterer modellen på Terminal-Bench 3.0 med 28.3 (vs. 4.6), DeepSWE v1.1 med 66.9 (vs. 46.2), Agents' Last Exam med 28.5 (vs. 23.8) og CyberGym med 84.5 – alle mod den tidligere model.
Vægtene er ikke på Hugging Face endnu. Z.ai open source-udgav den tidligere model under MIT-licensen, så en udgivelse der er bredt forventet, men den er ikke offentliggjort pr. august 2026.
Parametertallet er ikke offentliggjort; den officielle side angiver 1M-token kontekst og 128K maksimal output. Totalerne følger sandsynligvis GLM 5-familiens MoE-arkitektur.
Vægtene forventes under MIT-licensen efter den tidligere udgivelse på Hugging Face. Z.ai har ikke bekræftet licensen endnu, så behandl open-weights-detaljer som ubekræftede.
GLM Coding Plan – Z.ai's abonnement til AI-kodningsværktøjer som Claude Code, Cline og OpenCode – har rullet modellen fuldt ud. Det er et abonnement, ikke en åben API.
Den nye model beholder den tidligere base med meget større langhorisont-posttræning; kodningsoplevelsen forbedres med omkring 50%, plus white-box-kodegennemgang.
Chat med modellen gratis i glm5.app Chat i dag; GLM Coding Plan serverer den også. Den offentlige model-API forventes at gå live snart.
Ja – glm5.3, GLM-5.3 og GLM 5.3 er stavevarianter af den samme model. I glm5.app's offentlige API skal du bruge `glm-5.3` som model-ID.
Start here
Chat med modellen gratis på glm5.app, og følg den officielle API, priser og open source-nyheder her.