GLM 5.3 offiziell angekündigt

GLM 5.3

GLM 5.3 ist das neue Flaggschiff-Large-Language-Modell von Zhipu AI (Z.ai): 1M-token Kontext, 128K maximale Ausgabe und Top-Open-Source-Coding-Benchmarks. Chatte kostenlos mit GLM 5.3 auf glm5.app und verfolge hier Preise und Open-Source-News.

Mit GLM 5 erstellen

Was ist das GLM 5.3-Modell?

GLM 5.3 ist das neue Flaggschiff-Large-Language-Modell von Zhipu AI (Z.ai), angekündigt im August 2026, aufgebaut auf der GLM 5.2-Basis mit umfangreichem Long-Horizon-Post-Training.

01

Das neue Z.ai-Flaggschiff

Das neueste Flaggschiff-Basismodell von Z.ai: 1M-token Kontextfenster, 128K maximale Ausgabe und Text-in/Text-out-Modalität.

02

Gleiche Basis, deutlich mehr Training

Es nutzt die GLM 5.2-Basis und fügt über echte Compute-Cluster, Storage, Doku und Codebasen hinweg ein vielfach größeres Long-Horizon-Post-Training hinzu; Z.ai spricht von einer um etwa 50% besseren Coding-Feel.

03

Ein ehrlicher Release-Tracker

Die GLM 5.3-Modell-API kommt bald, daher trennt diese Seite, was Z.ai bestätigt hat (Specs und Benchmarks), von dem, was noch aussteht (API-ID, Preise, Gewichte und Lizenz).

GLM 5.3 Release-Status: Bestätigte Fakten und ausstehende Details

Z.ai hat Specs und Benchmarks bestätigt. API-Zugang, Preise und offene Gewichte stehen noch aus.

Von Z.ai bestätigt

Verifizierte Fakten

Kontextfenster
1M tokens

Die offizielle Modellseite listet ein 1M-token Kontextfenster.

Maximale Ausgabe
128K tokens

Offizielle maximale Output-Tokens pro Antwort.

Modalität
Text in / Text out

Text-Basismodell; kein Vision- oder multimodaler Input dokumentiert.

GLM Coding Plan
Live

Das Modell wurde im Z.ai Coding Plan-Abo vollständig ausgerollt.

Modell-API
Demnächst

Z.ai sagt, die Modell-API gehe in Kürze live, ohne ein festes Datum zu nennen.

Ausstehende offizielle Details

Beobachtete Erwartungen

API-Preise
Nicht angekündigt

Die API des bisherigen Flaggschiffs kostet etwa $1.40 Eingabe / $4.40 Ausgabe pro 1M tokens.

Offene Gewichte
Erwartet, unbestätigt

GLM 5.2 erscheint unter MIT auf Hugging Face; die neuen Gewichte und die Lizenz sind noch nicht veröffentlicht.

Parameter
Nicht veröffentlicht

Z.ai hat keine Parameterzahlen veröffentlicht.

Offizielle Modell-ID
Erwartet: glm-5.3

Die öffentliche API-Modell-ID auf glm5.app ist `glm-5.3`.

Der Status wird gegen die öffentliche Kommunikation von Z.ai geprüft (Stand August 2026). Details, die nicht als bestätigt markiert sind, sollten bis zu einer Ankündigung von Z.ai als unverifiziert behandelt werden.

Benchmarks / 02

GLM 5.3 Benchmarks im Vergleich zu GLM 5.2: als Ausgangspunkt nutzen

Z.ai berichtet große Benchmark-Zuwächse, doch ein Score gilt nur für das veröffentlichte Setup und Datum. Reproduziere eine Aufgabe, die deinem eigenen Workflow ähnelt, bevor du entscheidest.

01

Von Z.ai berichtetes Ergebnis

Terminal-Bench 3.0

5.328.3
5.24.6

Z.ai berichtet 28.3 gegenüber 4.6 für GLM 5.2 auf Terminal-Bench 3.0 – der größte gemeldete Sprung.

02

Von Z.ai berichtetes Ergebnis

DeepSWE v1.1

5.366.9
5.246.2

Z.ai berichtet 66.9 gegenüber 46.2 für GLM 5.2 auf DeepSWE v1.1, einem Long-Horizon-Engineering-Benchmark.

03

Von Z.ai berichtetes Ergebnis

Agents' Last Exam

5.328.5
5.223.8

Z.ai berichtet 28.5 gegenüber 23.8 für GLM 5.2 auf Agents' Last Exam, abgedeckt werden agentisches Wissen und Reasoning.

04

Von Z.ai berichtetes Ergebnis

CyberGym

5.384.5
GPT-5.6 Sol83.6

Z.ai berichtet 84.5 auf CyberGym, knapp über GPT-5.6 Sol mit 83.6 – ein veröffentlichtes Ergebnis, keine Garantie für deinen Security-Workflow.

Fähigkeiten / 03

GLM 5.3-Fähigkeiten

Es unterstützt den Standard-Developer-Stack für agentische und Long-Horizon-Arbeit, mit 1M-token Kontext für Aufgaben in Projektgröße.

01

Thinking-Modi

Mehrere Thinking-Modi erlauben es dir, Reasoning-Tiefe gegen Latenz abzuwägen – passend zur jeweiligen Aufgabe.

02

Function Calling

Starke Tool-Calling-Unterstützung für externe Integrationen, wobei deine Anwendung jede angeforderte Aktion validiert und ausführt.

03

Streaming-Ausgabe

Echtzeit-Streaming-Antworten für interaktiven Chat und Agent-Loops.

04

Context-Caching

Intelligentes Caching optimiert lange Konversationen und wiederkehrenden Kontext und senkt die Kosten bei Long-Horizon-Sessions.

05

Strukturierte Ausgabe

JSON und andere strukturierte Ausgabeformate machen die Systemintegration vorhersehbar.

06

MCP-Support

GLM 5.3 kann externe MCP-Tools und Datenquellen aufrufen und erweitert Agent-Workflows über den Chat hinaus.

Release-Zeitlinie / 04

GLM 5.3 Release-Zeitlinie und News

Die Meilensteine, die zu GLM 5.3 geführt haben, und was noch kommt – aktualisiert, sobald Z.ai offizielle News veröffentlicht.

01

16. Juni 2026 – GLM 5.2 startet

GLM 5.2 startete für Langzeitaufgaben mit einem 1M-token Kontextfenster und Kontrolle über den Anstrengungsgrad.

02

August 2026 – GLM 5.3 angekündigt

Z.ai veröffentlichte die offizielle Modellseite und Benchmark-Ergebnisse und bezeichnete es als neues Flaggschiff auf GLM 5.2-Basis.

03

August 2026 – Coding Plan geht live

Das GLM Coding Plan-Abo rollte das Modell vollständig für Coding-Tools wie Claude Code, Cline und OpenCode aus.

04

Als Nächstes – GLM 5.3-Modell-API

Z.ai sagt, die API komme bald. Offizielle Modell-ID, Limits und Preise werden hier nach der Ankündigung aktualisiert.

05

Als Nächstes – offene Gewichte und Lizenz

GLM 5.3-Gewichte und Lizenzdetails dürften dem MIT-Präzedenzfall von GLM 5.2 auf Hugging Face folgen, vorbehaltlich offizieller Bestätigung.

06

Wo GLM 5.3-News zuerst erscheinen

Folge dem Z.ai Blog, dem GitHub-Repository zai-org und der offiziellen bigmodel-Dokumentation für die ersten API-Ankündigungen.

Für wen es ist / 05

Wer nutzt GLM 5.3?

Gerichtet an Teams, die Long-Horizon-Engineering, agentische Workflows und Security-Reviews betreiben.

01

Anwendungsentwickler

Entwickler von Coding-Assistenten und IDE-Workflows profitieren vom gemeldeten 50%-Gewinn beim Coding-Feel und vom 1M-token Kontext für Arbeit am gesamten Repository.

02

Agent-Entwickler

Agent-Teams nutzen Thinking-Modi, Function Calling, Streaming und MCP, um langlebige autonome Workflows mit klaren Stoppbedingungen zu bauen.

03

Security-Forschende

Es zeigt Stärken bei White-Box-Code-Reviews und der Suche nach Schwachstellen (CyberGym 84.5) – nützlich als Assistenten-Schicht, die Experten weiterhin prüfen.

04

Long-Horizon-Engineering-Teams

Teams, die über zig tausend Zeilen und dutzende Dateien hinweg arbeiten, nutzen es für Refactor-Planung, Bug-Fixes und Projektabschlüsse mit minimaler Betreuung.

05

API- und Plattform-Teams

Plattform-Teams verfolgen API-Preise und -Limits, um vor dem Live-Gang der offiziellen API Budget für Context-Caching und strukturierte Ausgabe einzuplanen.

06

Open-Source-Community

Self-Hoster achten auf offene Gewichte auf Hugging Face, um Hardware, Quantisierung und Lizenzprüfung nach dem bisherigen MIT-Präzedenzfall zu planen.

So nutzt du GLM 5.3 / 06

So nutzt du GLM 5.3

Heute im glm5.app Chat verfügbar, die offizielle Modell-API dürfte folgen.

01
01

Starte einen GLM 5.3 Chat

Öffne den GLM 5.3 Chat auf glm5.app, beschreibe Problem, Rahmenbedingungen und gewünschtes Ergebnis und verfeinere die Antwort mit deinem eigenen Code und deinen Abnahmekriterien.

02
02

GLM Coding Plan abonnieren

Für Coding-Tool-Integrationen jetzt schon: Der Z.ai Coding Plan liefert das Modell bereits in Tools wie Claude Code, Cline und OpenCode aus.

03
03

Integrieren, sobald die API live ist

Für den glm5.app API-Zugriff verwende die Modell-ID `glm-5.3` mit der OpenAI-kompatiblen Base URL `https://glm5.app/api/v1`.

Integration specimen

Starte mit der GLM 5.3 API

Die offizielle GLM 5.3-Modell-API kommt bald von Z.ai. glm5.app bietet heute bereits einen OpenAI-kompatiblen Chat Completions-Endpunkt, und die offizielle Modell-ID wird hier nach Veröffentlichung ergänzt. Halte API-Keys serverseitig, starte mit einer schmalen Anfrage und halte die erwartete Antwortstruktur fest, bevor du skalierst.

API-Dokumentation öffnen
Request previewcurl
curl https://glm5.app/api/v1/chat/completions \
  -H "Authorization: Bearer $GLM5_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-5.3",
    "messages": [{
      "role": "user",
      "content": "Plan this refactor and list the rollback steps."
    }]
  }'

GLM 5.3 FAQ

Klare GLM 5.3-Antworten zu Release-Datum, Preisen, Benchmarks, Hugging Face, Parametern, Gewichten, dem Coding Plan und GLM 5.3 im Vergleich zu 5.2.

Was ist GLM 5.3?

GLM 5.3 ist das neue Flaggschiff-Large-Language-Modell von Z.ai, angekündigt im August 2026. Es behält die GLM 5.2-Basis mit deutlich größerem Long-Horizon-Post-Training und einem 1M-token Kontext.


Wann ist das GLM 5.3 Release-Datum?

Die offizielle Modellseite und Benchmarks erschienen im August 2026. Der GLM Coding Plan liefert es bereits aus, und die Modell-API soll in Kürze live gehen.


Wie sind die GLM 5.3-Preise?

API-Preise wurden nicht veröffentlicht. Als Referenz kostet das bisherige Flaggschiff etwa $1.40 Eingabe und $4.40 Ausgabe pro Million Tokens. glm5.app bietet kostenlose Chat-Credits, und die Preise werden hier nach der Ankündigung aktualisiert.


Was sind die GLM 5.3-Benchmarks?

Z.ai berichtet Terminal-Bench 3.0 mit 28.3 (gegenüber 4.6), DeepSWE v1.1 mit 66.9 (gegenüber 46.2), Agents' Last Exam mit 28.5 (gegenüber 23.8) und CyberGym mit 84.5 – jeweils im Vergleich zum Vorgängermodell. Scores gelten nur für das veröffentlichte Setup.


Ist GLM 5.3 auf Hugging Face?

Die Gewichte sind noch nicht auf Hugging Face. Z.ai hat das Vorgängermodell unter der MIT-Lizenz als Open Source veröffentlicht, daher wird ein Release dort breit erwartet – veröffentlicht wurde es Stand August 2026 aber noch nicht.


Wie viele Parameter hat GLM 5.3?

Parameterzahlen sind nicht veröffentlicht; die offizielle Seite listet 1M-token Kontext und 128K maximale Ausgabe. Die Gesamtzahlen dürften der MoE-Architektur der GLM-5-Familie folgen.


Werden die GLM 5.3-Gewichte Open Source sein?

Die Gewichte werden unter der MIT-Lizenz erwartet, nach dem Vorgänger-Release auf Hugging Face. Z.ai hat die Lizenz noch nicht bestätigt, daher behandle Details zu offenen Gewichten als unbestätigt.


Was ist der GLM 5.3 Coding Plan?

Der GLM Coding Plan – das Z.ai-Abo für AI-Coding-Tools wie Claude Code, Cline und OpenCode – hat das neue Modell vollständig ausgerollt. Es ist ein Abo, keine offene API.


GLM 5.3 im Vergleich zu GLM 5.2: Was hat sich geändert?

Das neue Modell behält die bisherige Basis mit deutlich größerem Long-Horizon-Post-Training; das Coding-Feel verbessert sich um etwa 50%. Zuwächse: Terminal-Bench 3.0 von 4.6 auf 28.3, DeepSWE v1.1 von 46.2 auf 66.9, plus White-Box-Code-Review.


Wie kann ich GLM 5.3 jetzt nutzen?

Chatte jetzt kostenlos im glm5.app Chat mit ihm; auch der GLM Coding Plan liefert es aus. Die öffentliche Modell-API soll bald live gehen, und diese Seite wird nach der Ankündigung um die offizielle ID und Limits ergänzt.


Ist glm5.3 dasselbe wie GLM 5.3?

Ja – glm5.3, GLM-5.3 und GLM 5.3 sind Schreibvarianten desselben Modells. In der öffentlichen API von glm5.app verwende `glm-5.3` als Modell-ID.


Start here

Starte noch heute mit GLM 5.3

Chatte kostenlos mit GLM 5.3 auf glm5.app und verfolge hier die offizielle API, Preise und Open-Source-News.