API GLM-5.3 — Guide de démarrage rapide du modèle phare de Zhipu
GLM-5.3 est le modèle phare actuel de Zhipu AI / Z.ai pour le code et les agents à long terme — même base que GLM-5.2, avec des gains généralisés issus de la mise à l'échelle post-entraînement (Terminal-Bench 3.0 de 4,6 à 28,3), un solide contexte de 1M de tokens et des poids ouverts sur Hugging Face depuis le 28 août. Sur ChinaModelAPI, les ID glm-5.2 / glm-5.1 continuent de fonctionner pendant la transition vers l'ID de relais glm-5.3.
Réponse directe (août 2026)
Modèle phare actuel de Zhipu = GLM-5.3 (sorti le 14 août 2026 — même base que GLM-5.2, tous les gains provenant de la mise à l'échelle post-entraînement ; Terminal-Bench 3.0 de 4,6 à 28,3, CyberGym 84,5 %). Z.ai a rendu l'API disponible (GA) le 19 août à 1,40 $ / 4,40 $ par 1M de tokens (0,26 $ en cache) et a publié les poids ouverts le 28 août (zai-org/GLM-5.3, licence personnalisée). ID cible via ChinaModelAPI : glm-5.3 sur https://api.chinamodelapi.com/v1, actif une fois le contrôle de santé du relais terminé — d'ici là, glm-5.2 / glm-5.1 continuent de fonctionner ; confirmez l'alias actif dans votre tableau de bord. Interface produit officielle : z.ai / chat.z.ai. Également nouveau : GLM-5.3-Flash — poids ouverts à environ 1/10 du prix du modèle phare.
Sources : blog de Z.ai « GLM-5.3 » (2026-08-14) ; blog de Z.ai « GLM-5.2: Built for Long-Horizon Tasks » (2026-06-16) ; publication des poids zai-org/GLM-5.3 sur Hugging Face (2026-08-28).
Ce qui a changé par rapport aux anciennes gammes GLM
- GLM-5.3 — modèle phare actuel (14 août 2026) : même base que le 5.2, tous les gains provenant de la mise à l'échelle post-entraînement ; Terminal-Bench 3.0 4.6→28.3, CyberGym 84,5 % ; poids ouverts depuis le 28 août (licence personnalisée) ; le jumeau GLM-5.3-Flash publie des poids ouverts à ~1/10 du prix
- GLM-5.2 — modèle à poids ouverts pour l'ingénierie logicielle & les agents à long terme, contexte de ~1M, poids MIT ; l'ID de production sur ChinaModelAPI qui continue de fonctionner aujourd'hui
- GLM-5.1 — étape précédente de la série 5.x (toujours utile pour les tests A/B coût/latence)
- Les anciennes appellations commerciales comme GLM-4.5 / 4-Plus sont dépassées pour un positionnement « dernier cri » — privilégiez la gamme 5.x (modèle phare actuel : GLM-5.3) dans les textes de présentation
Points forts
- Boucles de code multi-étapes longues / agents de type harness (Terminal-Bench 3.0 : 28,3)
- Capacités émergentes en cybersécurité (CyberGym 84,5 %) — à utiliser de manière responsable
- Qualité frontier à poids ouverts compétitive, moins chère que les API fermées américaines
- Option d'auto-hébergement lorsque les données doivent rester on-premise (licence glm-5.3 personnalisée)
- L'UX produit bilingue ZH/EN reste solide
Python
from openai import OpenAI
client = OpenAI(api_key="YOUR_KEY", base_url="https://api.chinamodelapi.com/v1")
resp = client.chat.completions.create(
model="glm-5.3",
messages=[
{"role": "system", "content": "You are a senior software engineer. Plan then implement."},
{"role": "user", "content": "Add retry + timeout to this HTTP client and write tests."},
],
temperature=0.2,
)
print(resp.choices[0].message.content)
Node.js
import OpenAI from "openai";
const client = new OpenAI({
apiKey: process.env.CHINAMODELAPI_KEY,
baseURL: "https://api.chinamodelapi.com/v1",
});
const resp = await client.chat.completions.create({
model: "glm-5.3",
messages: [{ role: "user", content: "Refactor this service for idempotent webhooks." }],
});
console.log(resp.choices[0].message.content);
Conseil de routage
Acheminez par défaut le trafic de code/agents en production vers glm-5.3 une fois que l'ID de relais a terminé son contrôle de santé — d'ici là, glm-5.2 / glm-5.1 continuent de fonctionner ; confirmez les alias actifs dans votre tableau de bord. Conservez la classification massive et courte sur des identifiants plus économiques comme le niveau GLM-5.3-Flash. Pour les paquets multi-documents extrêmes, évaluez aussi Kimi K3.
FAQ
Le dernier GLM est-il toujours le 4.5 ?
Non. Le modèle phare actuel de Zhipu est GLM-5.3 (sorti le 14 août 2026, après GLM-5.2 / 5 / 5.1). Z.ai a rendu l'API 5.3 disponible (GA) le 19 août et publié les poids ouverts le 28 août ; via ChinaModelAPI, glm-5.2 / glm-5.1 continuent de fonctionner tandis que l'ID de relais glm-5.3 termine son contrôle de santé.
GLM-5.3 est-il open source ?
Oui — Zhipu a publié des poids ouverts sur Hugging Face (zai-org/GLM-5.3) le 28 août 2026 sous une licence glm-5.3 personnalisée (GLM-5.2 était sous MIT) ; l'API cloud reste la voie la plus simple via des passerelles compatibles OpenAI comme ChinaModelAPI.
Fenêtre de contexte ?
GLM-5.3 est commercialisé avec un solide contexte de 1M de tokens pour les travaux à long terme. Confirmez les limites en direct dans le tableau de bord de votre fournisseur.
GLM-5.3 vs Kimi K3 ?
Les deux sont des lignes frontier chinoises de 2026. GLM-5.3 est le modèle phare code/agents renforcé par post-entraînement ; Kimi K3 est le modèle phare multimodal de classe 2.8T et à contexte 1M de Moonshot. Comparez sur votre propre jeu d'évaluation.