Résultat rapporté par Z.ai
Terminal-Bench 3.0
Z.ai rapporte 28.3 contre 4.6 pour GLM 5.2 sur Terminal-Bench 3.0 — le plus grand bond rapporté.
GLM 5.3 est le nouveau grand modèle de langage phare de Zhipu AI (Z.ai) : contexte 1M-token, sortie maximale de 128K et benchmarks de codage open source au sommet.
GLM 5.3 est le nouveau grand modèle de langage phare de Zhipu AI (Z.ai), annoncé en août 2026, construit sur la base de GLM 5.2 avec un post-entraînement à long horizon à grande échelle.
Le dernier modèle de base phare de Z.ai : fenêtre de contexte de 1M-token, sortie maximale de 128K et modalité texte en entrée, texte en sortie.
Il utilise la base de GLM 5.2 et ajoute des dizaines de fois plus de post-entraînement à long horizon sur de véritables clusters de calcul, stockages, documentations et bases de code ; Z.ai affirme que la sensation de codage s'améliore d'environ 50 %.
L'API du modèle le modèle arrive bientôt, cette page sépare donc ce que Z.ai a confirmé (specs et benchmarks) de ce qui reste en attente (identifiant API, tarif, poids et licence).
Z.ai a confirmé les specs et les benchmarks.
Confirmé par Z.ai
La page officielle du modèle indique une fenêtre de contexte de 1M-token.
Nombre maximal de tokens de sortie officiel par réponse.
Modèle de base textuel ; aucune vision ni entrée multimodale n'est documentée.
L'abonnement Z.ai Coding Plan a entièrement déployé le modèle.
Z.ai indique que l'API du modèle sera bientôt en ligne, sans date ferme publiée.
Détails officiels en attente
L'API du précédent fleuron coûte environ $1.40 en entrée / $4.40 en sortie par 1M de tokens.
GLM 5.2 est distribué sous licence MIT sur Hugging Face ; les nouveaux poids et la licence ne sont pas encore publiés.
Z.ai n'a pas publié le nombre total de paramètres.
L'identifiant de modèle de l'API publique glm5.app est `glm-5.3`.
Le statut est vérifié par rapport aux communications publiques de Z.ai en août 2026.
Benchmarks / 02
Z.ai rapporte des gains de benchmark importants, mais un score ne s'applique qu'au harnais et à la date publiés.
Résultat rapporté par Z.ai
Z.ai rapporte 28.3 contre 4.6 pour GLM 5.2 sur Terminal-Bench 3.0 — le plus grand bond rapporté.
Résultat rapporté par Z.ai
Z.ai rapporte 66.9 contre 46.2 pour GLM 5.2 sur DeepSWE v1.1, un benchmark d'ingénierie à long horizon.
Résultat rapporté par Z.ai
Z.ai rapporte 28.5 contre 23.8 pour GLM 5.2 sur Agents' Last Exam, couvrant les connaissances et le raisonnement agentiques.
Résultat rapporté par Z.ai
Z.ai rapporte 84.5 sur CyberGym, légèrement au-dessus de GPT-5.6 Sol à 83.6 — un résultat publié, pas une garantie pour votre flux de sécurité.
Capacités / 03
Il prend en charge la pile de développement standard pour le travail agentique et à long horizon, avec un contexte de 1M-token pour les tâches à l'échelle d'un projet.
Plusieurs modes de réflexion vous permettent d'équilibrer la profondeur du raisonnement et la latence, selon la tâche en cours.
Un support solide de l'appel d'outils pour les intégrations externes, votre application validant et exécutant chaque action demandée.
Réponses en streaming en temps réel pour le chat interactif et les boucles d'agents.
Un cache intelligent optimise les longues conversations et les contextes répétés, réduisant les coûts des sessions à long horizon.
Les formats JSON et autres formats de sortie structurée rendent l'intégration système prévisible.
GLM 5.3 peut appeler des outils et sources de données MCP externes, étendant les flux agentiques au-delà du chat.
Chronologie de sortie / 04
Les jalons qui ont mené à GLM 5.3, et ce qu'il reste à publier, mis à jour au fil des annonces officielles de Z.ai.
GLM 5.2 a été lancé pour les tâches à long horizon avec une fenêtre de contexte de 1M-token et un contrôle du niveau d'effort.
Z.ai a publié la page officielle du modèle et les résultats de benchmark, le qualifiant de nouveau fleuron construit sur la base de GLM 5.2.
L'abonnement GLM Coding Plan a entièrement déployé le modèle pour des outils de codage comme Claude Code, Cline et OpenCode.
Z.ai indique que l'API arrive bientôt. L'identifiant officiel du modèle, les limites et le tarif seront mis à jour ici dès l'annonce.
Les poids et les détails de licence de GLM 5.3 devraient suivre le précédent MIT de GLM 5.2 sur Hugging Face, sous réserve de confirmation officielle.
Suivez le blog de Z.ai, le dépôt GitHub zai-org et la documentation officielle bigmodel pour les premières annonces API.
À qui s'adresse-t-il / 05
Conçu pour les équipes qui travaillent sur l'ingénierie à long horizon, les flux agentiques et la revue de sécurité.
Les développeurs qui construisent des assistants de codage et des flux IDE profitent du gain de sensation de codage rapporté de 50 % et du contexte de 1M-token pour le travail sur un dépôt entier.
Les équipes d'agents utilisent les modes de réflexion, l'appel de fonctions, le streaming et MCP pour construire des flux autonomes de longue durée avec des conditions d'arrêt claires.
Il montre des points forts en revue de code boîte blanche et détection de vulnérabilités (CyberGym 84.5), utile comme couche d'assistance que les experts valident toujours.
Les équipes qui travaillent sur des dizaines de milliers de lignes et des dizaines de fichiers l'utilisent pour planifier des refactorisations, corriger des bugs et livrer des projets avec un minimum d'accompagnement.
Les équipes plateforme suivent le tarif et les limites de l'API pour budgéter la mise en cache du contexte et la sortie structurée avant la mise en ligne de l'API officielle.
Les auto-hébergeurs guettent les poids ouverts sur Hugging Face pour planifier matériel, quantification et revue de licence, en suivant le précédent MIT.
Disponible dans le Chat glm5.app dès aujourd'hui, avec l'API officielle attendue ensuite.
Ouvrez le Chat GLM 5.3 sur glm5.app, décrivez le problème, les contraintes et le résultat souhaité, puis affinez la réponse avec votre propre code et vos critères d'acceptation.
Pour des intégrations dans les outils de codage dès aujourd'hui, le Z.ai Coding Plan le sert déjà dans des outils comme Claude Code, Cline et OpenCode.
Pour utiliser l'API glm5.app, utilisez l'identifiant de modèle `glm-5.3` avec l'URL de base compatible OpenAI `https://glm5.app/api/v1`.
Integration specimen
L'API officielle du modèle GLM 5.3 arrive bientôt de la part de Z.ai. glm5.app expose un point de terminaison Chat Completions compatible OpenAI dès aujourd'hui, et l'identifiant officiel du modèle sera ajouté ici dès sa publication.
Ouvrir la documentation APIcurl https://glm5.app/api/v1/chat/completions \
-H "Authorization: Bearer $GLM5_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.3",
"messages": [{
"role": "user",
"content": "Plan this refactor and list the rollback steps."
}]
}'Des réponses claires sur GLM 5.3 : date de sortie, tarif, benchmarks, Hugging Face, paramètres, poids, Coding Plan et GLM 5.3 vs 5.2.
La page officielle du modèle et les benchmarks sont arrivés en août 2026.
Le tarif API n'a pas été publié. À titre de référence, le précédent fleuron coûte environ $1.40 en entrée et $4.40 en sortie par million de tokens.
Le nombre de paramètres n'est pas publié ; la page officielle indique un contexte de 1M-token et une sortie maximale de 128K.
Les poids sont attendus sous licence MIT, suivant la précédente publication sur Hugging Face.
Le GLM Coding Plan — l'abonnement Z.ai pour les outils de codage IA comme Claude Code, Cline et OpenCode — a entièrement déployé le nouveau modèle.
Oui — glm5.3, GLM-5.3 et GLM 5.3 sont des variantes orthographiques du même modèle.
Start here
Discutez avec GLM 5.3 gratuitement sur glm5.app et suivez ici l'API officielle, le tarif et les actualités open source.