Z.ai-rapportert resultat
Terminal-Bench 3.0
Z.ai rapporterer 28.3 vs 4.6 for den forrige flaggskipmodellen på Terminal-Bench 3.0 – det største rapporterte hoppet.
GLM 5.3 er den nye frontmodellen fra Zhipu AI (Z.ai): 1M-token kontekst, 128K maksimal utdata og topp benchmarks innen åpen kildekode-koding. Chat gratis med modellen på glm5.app.
GLM 5.3 er den nye frontmodellen fra Zhipu AI (Z.ai), annonsert i august 2026, bygget på forrige generasjons base med storskala langhorisont-ettertrening.
Den er Z.ais nyeste frontbase-modell: 1M-token kontekstvindu, 128K maksimal utdata og tekst-inn, tekst-ut modalitet.
Den bruker den forrige flaggskipbasen og legger til titalls ganger mer langhorisont-ettertrening på ekte dataklynger, lagring, dokumenter og kodebaser; Z.ai sier at kodefølelsen forbedres med omtrent 50%.
modellens API kommer snart, så denne siden skiller det Z.ai har bekreftet (spesifikasjoner og benchmarks) fra det som fortsatt venter (API-ID, prising, vekter og lisens).
Z.ai har bekreftet spesifikasjonene og benchmarkene. API-tilgang, prising og åpne vekter venter fortsatt på kunngjøringer.
Bekreftet av Z.ai
Den offisielle modellsiden oppgir et 1M-token kontekstvindu.
Offisiell maksimal utdata i tokens per svar.
Tekstbasert modell; ingen syns- eller multimodal inndata er dokumentert.
Z.ai Coding Plan-abonnementet har fullt rullet ut modellen.
Z.ai sier at modell-API-en vil lanseres snart og har ikke publisert en fast dato.
Ventende offisielle detaljer
Den forrige frontmodellens API koster omtrent $1.40 inn / $4.40 ut per 1M tokens.
Den forrige flaggskipmodellen utgis under MIT på Hugging Face; de nye vektene og lisensen er ikke publisert ennå.
Z.ai har ikke publisert parametertotaler.
Den offentlige API-modell-ID-en på glm5.app er `glm-5.3`.
Statusen er sjekket mot Z.ais offentlige kommunikasjon per august 2026. Detaljer som ikke er merket som bekreftet, bør behandles som uverifiserte inntil Z.ai annonserer dem.
Benchmarks / 02
Z.ai rapporterer store benchmark-framganger, men en poengsum gjelder bare for det publiserte testmiljøet og datoen. Reproducer en oppgave som ligner på din egen arbeidsflyt før du bestemmer deg.
Z.ai-rapportert resultat
Z.ai rapporterer 28.3 vs 4.6 for den forrige flaggskipmodellen på Terminal-Bench 3.0 – det største rapporterte hoppet.
Z.ai-rapportert resultat
Z.ai rapporterer 66.9 vs 46.2 for den forrige flaggskipmodellen på DeepSWE v1.1, en langhorisont ingeniørbenchmark.
Z.ai-rapportert resultat
Z.ai rapporterer 28.5 vs 23.8 for den forrige flaggskipmodellen på Agents' Last Exam, som dekker agentisk kunnskap og resonnering.
Z.ai-rapportert resultat
Z.ai rapporterer 84.5 på CyberGym, litt over GPT-5.6 Sol på 83.6.
Funksjoner / 03
Den støtter den standarde utviklerstakken for agentisk og langhorisont-arbeid, med 1M-token kontekst for prosjektstore oppgaver.
Flere tenkemåter lar deg balansere resonneringsdybde mot ventetid, tilpasset oppgaven som skal løses.
Sterk verktøykallstøtte for eksterne integrasjoner, med applikasjonen din som validerer og utfører hver forespurte handling.
Sanntids strømming av svar for interaktive chatter og agentløkker.
Smart bufring optimaliserer lange samtaler og gjentatt kontekst, og kutter kostnadene på langhorisont-økter.
JSON og andre strukturerte utdataformater gjør systemintegrasjon forutsigbar.
Den kan kalle eksterne MCP-verktøy og datakilder, og utvider agentarbeidsflyter utover chat.
Utgivelsestidslinje / 04
Milepælene som førte til modellen, og det som fortsatt gjenstår, oppdatert etter hvert som Z.ai publiserer offisielle nyheter.
GLM 5.2 ble lansert for langhorisont-oppgaver med et 1M-token kontekstvindu og innsatsnivåkontroll.
Z.ai publiserte den offisielle modellsiden og benchmark-resultatene, og utpekte den som den nye frontmodellen bygget på forrige base.
GLM Coding Plan-abonnementet rullet fullt ut modellen for kodeverktøy som Claude Code, Cline og OpenCode.
Z.ai sier at API-en kommer snart. Den offisielle modell-ID-en, grensene og prisingen oppdateres her når de annonseres.
vektene og lisensdetaljene forventes å følge MIT-presedensen til forrige modell på Hugging Face, i påvente av offisiell bekreftelse.
Følg Z.ai-bloggen, zai-org GitHub-repositoriet og de offisielle bigmodel-dokumentene for de første API-kunngjøringene.
Hvem det er for / 05
Rettet mot team som driver langhorisont-ingeniørarbeid, agentiske arbeidsflyter og sikkerhetsgjennomgang.
Utviklere som bygger kodeassistenter og IDE-arbeidsflyter, nyter godt for modellen sin rapporterte 50% forbedring i kodefølelse og 1M-token konteksten for arbeid på hele repositories.
Agentteam bruker modellens tenkemåter, funksjonskall, strømming og MCP for å bygge langvarige autonome arbeidsflyter med tydelige stoppbetingelser.
Den viser styrke i white-box kodegjennomgang og sårbarhetsavdekking (CyberGym 84.5), nyttig som et assistentlag som eksperter fortsatt validerer.
Team som jobber på tvers av titusenvis av kodelinjer og dusinvis av filer, bruker den til å planlegge refaktoreringer, fikse feil og levere prosjekter med minimal hjelp.
Plattformteam følger med på modellens API-prising og grenser for å budsjettere kontekstbufring og strukturert utdata før den offisielle API-en lanseres.
Selvverter følger med på modellens åpne vekter på Hugging Face for å planlegge maskinvare, kvantisering og lisensgjennomgang, etter den tidligere MIT-presedensen.
Tilgjengelig i glm5.app Chat i dag, med den offisielle modell-API-en forventet å følge.
Åpne GLM 5.3 Chat på glm5.app, beskriv problemet, begrensningene og ønsket resultat, og foredle deretter svaret med din egen kode og akseptansekriterier.
For kodeverktøyintegrasjoner i dag serverer Z.ai Coding Plan allerede modellen i verktøy som Claude Code, Cline og OpenCode.
For glm5.app API-tilgang bruker du modell-ID `glm-5.3` med den OpenAI-kompatible base-URL-en `https://glm5.app/api/v1`.
Integration specimen
Den offisielle GLM 5.3-modell-API-en kommer snart fra Z.ai. glm5.app tilbyr et OpenAI-kompatibelt Chat Completions-endepunkt i dag, og dens offisielle modell-ID-en legges til her når den publiseres. Hold API-nøkler på serveren, og skaler gradvist fra små forespørsler.
Åpne API-dokumentasjonencurl https://glm5.app/api/v1/chat/completions \
-H "Authorization: Bearer $GLM5_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.3",
"messages": [{
"role": "user",
"content": "Plan this refactor and list the rollback steps."
}]
}'Tydelige GLM 5.3-svar om utgivelsesdato, prising, benchmarks, Hugging Face, parametere, vekter, kodingsplanen og GLM 5.3 vs 5.2.
Det er Z.ais nye frontmodell, annonsert i august 2026. Den beholder GLM 5.2-basen med langt større langhorisont-ettertrening og 1M-token kontekst.
Den offisielle modellsiden og benchmarkene kom i august 2026. GLM Coding Plan serverer modellen allerede.
API-prisingen er ikke publisert. Som referanse koster den forrige frontmodellen omtrent $1.40 inn og $4.40 ut per million tokens. glm5.app tilbyr gratis chat-kreditter.
Z.ai rapporterer modellen på Terminal-Bench 3.0 med 28.3 (vs 4.6), DeepSWE v1.1 på 66.9 (vs 46.2), Agents' Last Exam på 28.5 (vs 23.8) og CyberGym på 84.5, alle mot den forrige modellen.
Vektene er ikke på Hugging Face ennå. Z.ai publiserte den forrige modellen som åpen kildekode under MIT-lisensen, så en utgivelse der er allment forventet, men den er ikke publisert per august 2026.
Parametertallet er ikke publisert; den offisielle siden oppgir 1M-token kontekst og 128K maksimal utdata. Totaltallene følger sannsynligvis GLM 5-familiens MoE-arkitektur.
Vektene forventes under MIT-lisensen, etter forrige utgivelse på Hugging Face. Z.ai har ikke bekreftet lisensen ennå, så behandle åpne vekter-detaljer som ubekreftede.
GLM Coding Plan – Z.ais abonnement for AI-kodeverktøy som Claude Code, Cline og OpenCode – har fullt rullet ut modellen. Det er et abonnement, ikke en åpen API.
Den nye modellen beholder den forrige basen med langt større langhorisont-ettertrening; kodingsfølelsen forbedres med omtrent 50%, pluss white-box kodegjennomgang.
Chat gratis med modellen i glm5.app Chat i dag; GLM Coding Plan serverer den også. Den offentlige modell-API-en forventes å lanseres snart.
Ja – glm5.3, GLM-5.3 og GLM 5.3 er stavevarianter av samme modell. I den offentlige API-en til glm5.app bruker du `glm-5.3` som modell-ID.
Start here
Chat gratis med modellen på glm5.app, og følg den offisielle API-en, prisingen og nyhetene om åpen kildekode her.