Von Z.ai berichtetes Ergebnis
Terminal-Bench 3.0
Z.ai berichtet 28.3 gegenüber 4.6 für GLM 5.2 auf Terminal-Bench 3.0 – der größte gemeldete Sprung.
GLM 5.3 ist das neue Flaggschiff-Large-Language-Modell von Zhipu AI (Z.ai): 1M-token Kontext, 128K maximale Ausgabe und Top-Open-Source-Coding-Benchmarks. Chatte kostenlos mit GLM 5.3 auf glm5.app und verfolge hier Preise und Open-Source-News.
GLM 5.3 ist das neue Flaggschiff-Large-Language-Modell von Zhipu AI (Z.ai), angekündigt im August 2026, aufgebaut auf der GLM 5.2-Basis mit umfangreichem Long-Horizon-Post-Training.
Das neueste Flaggschiff-Basismodell von Z.ai: 1M-token Kontextfenster, 128K maximale Ausgabe und Text-in/Text-out-Modalität.
Es nutzt die GLM 5.2-Basis und fügt über echte Compute-Cluster, Storage, Doku und Codebasen hinweg ein vielfach größeres Long-Horizon-Post-Training hinzu; Z.ai spricht von einer um etwa 50% besseren Coding-Feel.
Die GLM 5.3-Modell-API kommt bald, daher trennt diese Seite, was Z.ai bestätigt hat (Specs und Benchmarks), von dem, was noch aussteht (API-ID, Preise, Gewichte und Lizenz).
Z.ai hat Specs und Benchmarks bestätigt. API-Zugang, Preise und offene Gewichte stehen noch aus.
Von Z.ai bestätigt
Die offizielle Modellseite listet ein 1M-token Kontextfenster.
Offizielle maximale Output-Tokens pro Antwort.
Text-Basismodell; kein Vision- oder multimodaler Input dokumentiert.
Das Modell wurde im Z.ai Coding Plan-Abo vollständig ausgerollt.
Z.ai sagt, die Modell-API gehe in Kürze live, ohne ein festes Datum zu nennen.
Ausstehende offizielle Details
Die API des bisherigen Flaggschiffs kostet etwa $1.40 Eingabe / $4.40 Ausgabe pro 1M tokens.
GLM 5.2 erscheint unter MIT auf Hugging Face; die neuen Gewichte und die Lizenz sind noch nicht veröffentlicht.
Z.ai hat keine Parameterzahlen veröffentlicht.
Die öffentliche API-Modell-ID auf glm5.app ist `glm-5.3`.
Der Status wird gegen die öffentliche Kommunikation von Z.ai geprüft (Stand August 2026). Details, die nicht als bestätigt markiert sind, sollten bis zu einer Ankündigung von Z.ai als unverifiziert behandelt werden.
Benchmarks / 02
Z.ai berichtet große Benchmark-Zuwächse, doch ein Score gilt nur für das veröffentlichte Setup und Datum. Reproduziere eine Aufgabe, die deinem eigenen Workflow ähnelt, bevor du entscheidest.
Von Z.ai berichtetes Ergebnis
Z.ai berichtet 28.3 gegenüber 4.6 für GLM 5.2 auf Terminal-Bench 3.0 – der größte gemeldete Sprung.
Von Z.ai berichtetes Ergebnis
Z.ai berichtet 66.9 gegenüber 46.2 für GLM 5.2 auf DeepSWE v1.1, einem Long-Horizon-Engineering-Benchmark.
Von Z.ai berichtetes Ergebnis
Z.ai berichtet 28.5 gegenüber 23.8 für GLM 5.2 auf Agents' Last Exam, abgedeckt werden agentisches Wissen und Reasoning.
Von Z.ai berichtetes Ergebnis
Z.ai berichtet 84.5 auf CyberGym, knapp über GPT-5.6 Sol mit 83.6 – ein veröffentlichtes Ergebnis, keine Garantie für deinen Security-Workflow.
Fähigkeiten / 03
Es unterstützt den Standard-Developer-Stack für agentische und Long-Horizon-Arbeit, mit 1M-token Kontext für Aufgaben in Projektgröße.
Mehrere Thinking-Modi erlauben es dir, Reasoning-Tiefe gegen Latenz abzuwägen – passend zur jeweiligen Aufgabe.
Starke Tool-Calling-Unterstützung für externe Integrationen, wobei deine Anwendung jede angeforderte Aktion validiert und ausführt.
Echtzeit-Streaming-Antworten für interaktiven Chat und Agent-Loops.
Intelligentes Caching optimiert lange Konversationen und wiederkehrenden Kontext und senkt die Kosten bei Long-Horizon-Sessions.
JSON und andere strukturierte Ausgabeformate machen die Systemintegration vorhersehbar.
GLM 5.3 kann externe MCP-Tools und Datenquellen aufrufen und erweitert Agent-Workflows über den Chat hinaus.
Release-Zeitlinie / 04
Die Meilensteine, die zu GLM 5.3 geführt haben, und was noch kommt – aktualisiert, sobald Z.ai offizielle News veröffentlicht.
GLM 5.2 startete für Langzeitaufgaben mit einem 1M-token Kontextfenster und Kontrolle über den Anstrengungsgrad.
Z.ai veröffentlichte die offizielle Modellseite und Benchmark-Ergebnisse und bezeichnete es als neues Flaggschiff auf GLM 5.2-Basis.
Das GLM Coding Plan-Abo rollte das Modell vollständig für Coding-Tools wie Claude Code, Cline und OpenCode aus.
Z.ai sagt, die API komme bald. Offizielle Modell-ID, Limits und Preise werden hier nach der Ankündigung aktualisiert.
GLM 5.3-Gewichte und Lizenzdetails dürften dem MIT-Präzedenzfall von GLM 5.2 auf Hugging Face folgen, vorbehaltlich offizieller Bestätigung.
Folge dem Z.ai Blog, dem GitHub-Repository zai-org und der offiziellen bigmodel-Dokumentation für die ersten API-Ankündigungen.
Für wen es ist / 05
Gerichtet an Teams, die Long-Horizon-Engineering, agentische Workflows und Security-Reviews betreiben.
Entwickler von Coding-Assistenten und IDE-Workflows profitieren vom gemeldeten 50%-Gewinn beim Coding-Feel und vom 1M-token Kontext für Arbeit am gesamten Repository.
Agent-Teams nutzen Thinking-Modi, Function Calling, Streaming und MCP, um langlebige autonome Workflows mit klaren Stoppbedingungen zu bauen.
Es zeigt Stärken bei White-Box-Code-Reviews und der Suche nach Schwachstellen (CyberGym 84.5) – nützlich als Assistenten-Schicht, die Experten weiterhin prüfen.
Teams, die über zig tausend Zeilen und dutzende Dateien hinweg arbeiten, nutzen es für Refactor-Planung, Bug-Fixes und Projektabschlüsse mit minimaler Betreuung.
Plattform-Teams verfolgen API-Preise und -Limits, um vor dem Live-Gang der offiziellen API Budget für Context-Caching und strukturierte Ausgabe einzuplanen.
Self-Hoster achten auf offene Gewichte auf Hugging Face, um Hardware, Quantisierung und Lizenzprüfung nach dem bisherigen MIT-Präzedenzfall zu planen.
Heute im glm5.app Chat verfügbar, die offizielle Modell-API dürfte folgen.
Öffne den GLM 5.3 Chat auf glm5.app, beschreibe Problem, Rahmenbedingungen und gewünschtes Ergebnis und verfeinere die Antwort mit deinem eigenen Code und deinen Abnahmekriterien.
Für Coding-Tool-Integrationen jetzt schon: Der Z.ai Coding Plan liefert das Modell bereits in Tools wie Claude Code, Cline und OpenCode aus.
Für den glm5.app API-Zugriff verwende die Modell-ID `glm-5.3` mit der OpenAI-kompatiblen Base URL `https://glm5.app/api/v1`.
Integration specimen
Die offizielle GLM 5.3-Modell-API kommt bald von Z.ai. glm5.app bietet heute bereits einen OpenAI-kompatiblen Chat Completions-Endpunkt, und die offizielle Modell-ID wird hier nach Veröffentlichung ergänzt. Halte API-Keys serverseitig, starte mit einer schmalen Anfrage und halte die erwartete Antwortstruktur fest, bevor du skalierst.
API-Dokumentation öffnencurl https://glm5.app/api/v1/chat/completions \
-H "Authorization: Bearer $GLM5_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.3",
"messages": [{
"role": "user",
"content": "Plan this refactor and list the rollback steps."
}]
}'Klare GLM 5.3-Antworten zu Release-Datum, Preisen, Benchmarks, Hugging Face, Parametern, Gewichten, dem Coding Plan und GLM 5.3 im Vergleich zu 5.2.
GLM 5.3 ist das neue Flaggschiff-Large-Language-Modell von Z.ai, angekündigt im August 2026. Es behält die GLM 5.2-Basis mit deutlich größerem Long-Horizon-Post-Training und einem 1M-token Kontext.
Die offizielle Modellseite und Benchmarks erschienen im August 2026. Der GLM Coding Plan liefert es bereits aus, und die Modell-API soll in Kürze live gehen.
API-Preise wurden nicht veröffentlicht. Als Referenz kostet das bisherige Flaggschiff etwa $1.40 Eingabe und $4.40 Ausgabe pro Million Tokens. glm5.app bietet kostenlose Chat-Credits, und die Preise werden hier nach der Ankündigung aktualisiert.
Z.ai berichtet Terminal-Bench 3.0 mit 28.3 (gegenüber 4.6), DeepSWE v1.1 mit 66.9 (gegenüber 46.2), Agents' Last Exam mit 28.5 (gegenüber 23.8) und CyberGym mit 84.5 – jeweils im Vergleich zum Vorgängermodell. Scores gelten nur für das veröffentlichte Setup.
Die Gewichte sind noch nicht auf Hugging Face. Z.ai hat das Vorgängermodell unter der MIT-Lizenz als Open Source veröffentlicht, daher wird ein Release dort breit erwartet – veröffentlicht wurde es Stand August 2026 aber noch nicht.
Parameterzahlen sind nicht veröffentlicht; die offizielle Seite listet 1M-token Kontext und 128K maximale Ausgabe. Die Gesamtzahlen dürften der MoE-Architektur der GLM-5-Familie folgen.
Die Gewichte werden unter der MIT-Lizenz erwartet, nach dem Vorgänger-Release auf Hugging Face. Z.ai hat die Lizenz noch nicht bestätigt, daher behandle Details zu offenen Gewichten als unbestätigt.
Der GLM Coding Plan – das Z.ai-Abo für AI-Coding-Tools wie Claude Code, Cline und OpenCode – hat das neue Modell vollständig ausgerollt. Es ist ein Abo, keine offene API.
Das neue Modell behält die bisherige Basis mit deutlich größerem Long-Horizon-Post-Training; das Coding-Feel verbessert sich um etwa 50%. Zuwächse: Terminal-Bench 3.0 von 4.6 auf 28.3, DeepSWE v1.1 von 46.2 auf 66.9, plus White-Box-Code-Review.
Chatte jetzt kostenlos im glm5.app Chat mit ihm; auch der GLM Coding Plan liefert es aus. Die öffentliche Modell-API soll bald live gehen, und diese Seite wird nach der Ankündigung um die offizielle ID und Limits ergänzt.
Ja – glm5.3, GLM-5.3 und GLM 5.3 sind Schreibvarianten desselben Modells. In der öffentlichen API von glm5.app verwende `glm-5.3` als Modell-ID.
Start here
Chatte kostenlos mit GLM 5.3 auf glm5.app und verfolge hier die offizielle API, Preise und Open-Source-News.