GLM 5.3 est officiellement annoncé

GLM 5.3

GLM 5.3 est le nouveau grand modèle de langage phare de Zhipu AI (Z.ai) : contexte 1M-token, sortie maximale de 128K et benchmarks de codage open source au sommet.

Créez avec GLM 5

Qu'est-ce que le modèle le modèle ?

GLM 5.3 est le nouveau grand modèle de langage phare de Zhipu AI (Z.ai), annoncé en août 2026, construit sur la base de GLM 5.2 avec un post-entraînement à long horizon à grande échelle.

01

Le nouveau fleuron de Z.ai

Le dernier modèle de base phare de Z.ai : fenêtre de contexte de 1M-token, sortie maximale de 128K et modalité texte en entrée, texte en sortie.

02

Même base, entraînement bien plus poussé

Il utilise la base de GLM 5.2 et ajoute des dizaines de fois plus de post-entraînement à long horizon sur de véritables clusters de calcul, stockages, documentations et bases de code ; Z.ai affirme que la sensation de codage s'améliore d'environ 50 %.

03

Un suivi de sortie honnête

L'API du modèle le modèle arrive bientôt, cette page sépare donc ce que Z.ai a confirmé (specs et benchmarks) de ce qui reste en attente (identifiant API, tarif, poids et licence).

État de la sortie de GLM 5.3 : faits confirmés et détails en attente

Z.ai a confirmé les specs et les benchmarks.

Confirmé par Z.ai

Faits vérifiés

Fenêtre de contexte
1M tokens

La page officielle du modèle indique une fenêtre de contexte de 1M-token.

Sortie maximale
128K tokens

Nombre maximal de tokens de sortie officiel par réponse.

Modalité
Texte en entrée / texte en sortie

Modèle de base textuel ; aucune vision ni entrée multimodale n'est documentée.

Plan de codage GLM
En ligne

L'abonnement Z.ai Coding Plan a entièrement déployé le modèle.

API du modèle
Bientôt disponible

Z.ai indique que l'API du modèle sera bientôt en ligne, sans date ferme publiée.

Détails officiels en attente

Attentes suivies

Tarif API
Non annoncé

L'API du précédent fleuron coûte environ $1.40 en entrée / $4.40 en sortie par 1M de tokens.

Poids ouverts
Attendu, non confirmé

GLM 5.2 est distribué sous licence MIT sur Hugging Face ; les nouveaux poids et la licence ne sont pas encore publiés.

Paramètres
Non publié

Z.ai n'a pas publié le nombre total de paramètres.

Identifiant officiel du modèle
Attendu : glm-5.3

L'identifiant de modèle de l'API publique glm5.app est `glm-5.3`.

Le statut est vérifié par rapport aux communications publiques de Z.ai en août 2026.

Benchmarks / 02

Benchmarks de GLM 5.3 vs GLM 5.2 : utilisez-les comme point de départ

Z.ai rapporte des gains de benchmark importants, mais un score ne s'applique qu'au harnais et à la date publiés.

01

Résultat rapporté par Z.ai

Terminal-Bench 3.0

5.328.3
5.24.6

Z.ai rapporte 28.3 contre 4.6 pour GLM 5.2 sur Terminal-Bench 3.0 — le plus grand bond rapporté.

02

Résultat rapporté par Z.ai

DeepSWE v1.1

5.366.9
5.246.2

Z.ai rapporte 66.9 contre 46.2 pour GLM 5.2 sur DeepSWE v1.1, un benchmark d'ingénierie à long horizon.

03

Résultat rapporté par Z.ai

Agents' Last Exam

5.328.5
5.223.8

Z.ai rapporte 28.5 contre 23.8 pour GLM 5.2 sur Agents' Last Exam, couvrant les connaissances et le raisonnement agentiques.

04

Résultat rapporté par Z.ai

CyberGym

5.384.5
GPT-5.6 Sol83.6

Z.ai rapporte 84.5 sur CyberGym, légèrement au-dessus de GPT-5.6 Sol à 83.6 — un résultat publié, pas une garantie pour votre flux de sécurité.

Capacités / 03

Capacités de GLM 5.3

Il prend en charge la pile de développement standard pour le travail agentique et à long horizon, avec un contexte de 1M-token pour les tâches à l'échelle d'un projet.

01

Modes de réflexion

Plusieurs modes de réflexion vous permettent d'équilibrer la profondeur du raisonnement et la latence, selon la tâche en cours.

02

Appel de fonctions

Un support solide de l'appel d'outils pour les intégrations externes, votre application validant et exécutant chaque action demandée.

03

Sortie en streaming

Réponses en streaming en temps réel pour le chat interactif et les boucles d'agents.

04

Mise en cache du contexte

Un cache intelligent optimise les longues conversations et les contextes répétés, réduisant les coûts des sessions à long horizon.

05

Sortie structurée

Les formats JSON et autres formats de sortie structurée rendent l'intégration système prévisible.

06

Support MCP

GLM 5.3 peut appeler des outils et sources de données MCP externes, étendant les flux agentiques au-delà du chat.

Chronologie de sortie / 04

Chronologie de la sortie de GLM 5.3 et actualités

Les jalons qui ont mené à GLM 5.3, et ce qu'il reste à publier, mis à jour au fil des annonces officielles de Z.ai.

01

16 juin 2026 — Lancement de GLM 5.2

GLM 5.2 a été lancé pour les tâches à long horizon avec une fenêtre de contexte de 1M-token et un contrôle du niveau d'effort.

02

Août 2026 — Annonce de GLM 5.3

Z.ai a publié la page officielle du modèle et les résultats de benchmark, le qualifiant de nouveau fleuron construit sur la base de GLM 5.2.

03

Août 2026 — Le Coding Plan entre en ligne

L'abonnement GLM Coding Plan a entièrement déployé le modèle pour des outils de codage comme Claude Code, Cline et OpenCode.

04

Prochaine étape — API du modèle GLM 5.3

Z.ai indique que l'API arrive bientôt. L'identifiant officiel du modèle, les limites et le tarif seront mis à jour ici dès l'annonce.

05

Prochaine étape — poids ouverts et licence

Les poids et les détails de licence de GLM 5.3 devraient suivre le précédent MIT de GLM 5.2 sur Hugging Face, sous réserve de confirmation officielle.

06

Où les actualités GLM 5.3 paraissent en premier

Suivez le blog de Z.ai, le dépôt GitHub zai-org et la documentation officielle bigmodel pour les premières annonces API.

À qui s'adresse-t-il / 05

Qui utilise GLM 5.3 ?

Conçu pour les équipes qui travaillent sur l'ingénierie à long horizon, les flux agentiques et la revue de sécurité.

01

Développeurs d'applications

Les développeurs qui construisent des assistants de codage et des flux IDE profitent du gain de sensation de codage rapporté de 50 % et du contexte de 1M-token pour le travail sur un dépôt entier.

02

Créateurs d'agents

Les équipes d'agents utilisent les modes de réflexion, l'appel de fonctions, le streaming et MCP pour construire des flux autonomes de longue durée avec des conditions d'arrêt claires.

03

Chercheurs en sécurité

Il montre des points forts en revue de code boîte blanche et détection de vulnérabilités (CyberGym 84.5), utile comme couche d'assistance que les experts valident toujours.

04

Équipes d'ingénierie à long horizon

Les équipes qui travaillent sur des dizaines de milliers de lignes et des dizaines de fichiers l'utilisent pour planifier des refactorisations, corriger des bugs et livrer des projets avec un minimum d'accompagnement.

05

Équipes API et plateforme

Les équipes plateforme suivent le tarif et les limites de l'API pour budgéter la mise en cache du contexte et la sortie structurée avant la mise en ligne de l'API officielle.

06

Communauté open source

Les auto-hébergeurs guettent les poids ouverts sur Hugging Face pour planifier matériel, quantification et revue de licence, en suivant le précédent MIT.

Comment utiliser GLM 5.3 / 06

Comment utiliser GLM 5.3

Disponible dans le Chat glm5.app dès aujourd'hui, avec l'API officielle attendue ensuite.

01
01

Démarrez un chat GLM 5.3

Ouvrez le Chat GLM 5.3 sur glm5.app, décrivez le problème, les contraintes et le résultat souhaité, puis affinez la réponse avec votre propre code et vos critères d'acceptation.

02
02

Abonnez-vous au GLM Coding Plan

Pour des intégrations dans les outils de codage dès aujourd'hui, le Z.ai Coding Plan le sert déjà dans des outils comme Claude Code, Cline et OpenCode.

03
03

Intégrez quand l'API sera en ligne

Pour utiliser l'API glm5.app, utilisez l'identifiant de modèle `glm-5.3` avec l'URL de base compatible OpenAI `https://glm5.app/api/v1`.

Integration specimen

Commencez avec l'API GLM 5.3

L'API officielle du modèle GLM 5.3 arrive bientôt de la part de Z.ai. glm5.app expose un point de terminaison Chat Completions compatible OpenAI dès aujourd'hui, et l'identifiant officiel du modèle sera ajouté ici dès sa publication.

Ouvrir la documentation API
Request previewcurl
curl https://glm5.app/api/v1/chat/completions \
  -H "Authorization: Bearer $GLM5_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-5.3",
    "messages": [{
      "role": "user",
      "content": "Plan this refactor and list the rollback steps."
    }]
  }'

FAQ GLM 5.3

Des réponses claires sur GLM 5.3 : date de sortie, tarif, benchmarks, Hugging Face, paramètres, poids, Coding Plan et GLM 5.3 vs 5.2.

Quelle est la date de sortie de GLM 5.3 ?

La page officielle du modèle et les benchmarks sont arrivés en août 2026.


Quel est le tarif de GLM 5.3 ?

Le tarif API n'a pas été publié. À titre de référence, le précédent fleuron coûte environ $1.40 en entrée et $4.40 en sortie par million de tokens.


Combien de paramètres GLM 5.3 a-t-il ?

Le nombre de paramètres n'est pas publié ; la page officielle indique un contexte de 1M-token et une sortie maximale de 128K.


Les poids de GLM 5.3 seront-ils open source ?

Les poids sont attendus sous licence MIT, suivant la précédente publication sur Hugging Face.


Qu'est-ce que le Coding Plan GLM 5.3 ?

Le GLM Coding Plan — l'abonnement Z.ai pour les outils de codage IA comme Claude Code, Cline et OpenCode — a entièrement déployé le nouveau modèle.


glm5.3 est-il la même chose que GLM 5.3 ?

Oui — glm5.3, GLM-5.3 et GLM 5.3 sont des variantes orthographiques du même modèle.


Start here

Commencez avec GLM 5.3 dès aujourd'hui

Discutez avec GLM 5.3 gratuitement sur glm5.app et suivez ici l'API officielle, le tarif et les actualités open source.