ChinaModelAPI
Mise à jour · 2026-08-28

GLM-5.3 est désormais le modèle phare à poids ouverts : les poids sont arrivés sur Hugging Face le 28 août (zai-org/GLM-5.3, licence personnalisée). API en GA depuis le 19 août — 1,40 $ en entrée / 4,40 $ en sortie par 1M de tokens (0,26 $ en cache), disponible sur OpenRouter depuis le 18 août ; indice Artificial Analysis de 60 (rang 8/182). Changement cassant de l'API : thinking.type: "disabled" n'est plus pris en charge et échouera. Sur le relais ChinaModelAPI, glm-5.2 / glm-5.1 continuent de fonctionner tandis que l'ID glm-5.3 termine son contrôle de santé. Lire le brief de sortie →

Mis à jour le 2026-08-31 · Guide

API GLM-5.3 — Guide de démarrage rapide du modèle phare de Zhipu

GLM-5.3 est le modèle phare actuel de Zhipu AI / Z.ai pour le code et les agents à long terme — même base que GLM-5.2, avec des gains généralisés issus de la mise à l'échelle post-entraînement (Terminal-Bench 3.0 de 4,6 à 28,3), un solide contexte de 1M de tokens et des poids ouverts sur Hugging Face depuis le 28 août. Sur ChinaModelAPI, les ID glm-5.2 / glm-5.1 continuent de fonctionner pendant la transition vers l'ID de relais glm-5.3.

Réponse directe (août 2026)

Modèle phare actuel de Zhipu = GLM-5.3 (sorti le 14 août 2026 — même base que GLM-5.2, tous les gains provenant de la mise à l'échelle post-entraînement ; Terminal-Bench 3.0 de 4,6 à 28,3, CyberGym 84,5 %). Z.ai a rendu l'API disponible (GA) le 19 août à 1,40 $ / 4,40 $ par 1M de tokens (0,26 $ en cache) et a publié les poids ouverts le 28 août (zai-org/GLM-5.3, licence personnalisée). ID cible via ChinaModelAPI : glm-5.3 sur https://api.chinamodelapi.com/v1, actif une fois le contrôle de santé du relais terminé — d'ici là, glm-5.2 / glm-5.1 continuent de fonctionner ; confirmez l'alias actif dans votre tableau de bord. Interface produit officielle : z.ai / chat.z.ai. Également nouveau : GLM-5.3-Flash — poids ouverts à environ 1/10 du prix du modèle phare.

Sources : blog de Z.ai « GLM-5.3 » (2026-08-14) ; blog de Z.ai « GLM-5.2: Built for Long-Horizon Tasks » (2026-06-16) ; publication des poids zai-org/GLM-5.3 sur Hugging Face (2026-08-28).

Ce qui a changé par rapport aux anciennes gammes GLM

  • GLM-5.3 — modèle phare actuel (14 août 2026) : même base que le 5.2, tous les gains provenant de la mise à l'échelle post-entraînement ; Terminal-Bench 3.0 4.6→28.3, CyberGym 84,5 % ; poids ouverts depuis le 28 août (licence personnalisée) ; le jumeau GLM-5.3-Flash publie des poids ouverts à ~1/10 du prix
  • GLM-5.2 — modèle à poids ouverts pour l'ingénierie logicielle & les agents à long terme, contexte de ~1M, poids MIT ; l'ID de production sur ChinaModelAPI qui continue de fonctionner aujourd'hui
  • GLM-5.1 — étape précédente de la série 5.x (toujours utile pour les tests A/B coût/latence)
  • Les anciennes appellations commerciales comme GLM-4.5 / 4-Plus sont dépassées pour un positionnement « dernier cri » — privilégiez la gamme 5.x (modèle phare actuel : GLM-5.3) dans les textes de présentation

Points forts

  • Boucles de code multi-étapes longues / agents de type harness (Terminal-Bench 3.0 : 28,3)
  • Capacités émergentes en cybersécurité (CyberGym 84,5 %) — à utiliser de manière responsable
  • Qualité frontier à poids ouverts compétitive, moins chère que les API fermées américaines
  • Option d'auto-hébergement lorsque les données doivent rester on-premise (licence glm-5.3 personnalisée)
  • L'UX produit bilingue ZH/EN reste solide

Python

from openai import OpenAI
client = OpenAI(api_key="YOUR_KEY", base_url="https://api.chinamodelapi.com/v1")
resp = client.chat.completions.create(
    model="glm-5.3",
    messages=[
        {"role": "system", "content": "You are a senior software engineer. Plan then implement."},
        {"role": "user", "content": "Add retry + timeout to this HTTP client and write tests."},
    ],
    temperature=0.2,
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";
const client = new OpenAI({
  apiKey: process.env.CHINAMODELAPI_KEY,
  baseURL: "https://api.chinamodelapi.com/v1",
});
const resp = await client.chat.completions.create({
  model: "glm-5.3",
  messages: [{ role: "user", content: "Refactor this service for idempotent webhooks." }],
});
console.log(resp.choices[0].message.content);

Conseil de routage

Acheminez par défaut le trafic de code/agents en production vers glm-5.3 une fois que l'ID de relais a terminé son contrôle de santé — d'ici là, glm-5.2 / glm-5.1 continuent de fonctionner ; confirmez les alias actifs dans votre tableau de bord. Conservez la classification massive et courte sur des identifiants plus économiques comme le niveau GLM-5.3-Flash. Pour les paquets multi-documents extrêmes, évaluez aussi Kimi K3.

FAQ

Le dernier GLM est-il toujours le 4.5 ?

Non. Le modèle phare actuel de Zhipu est GLM-5.3 (sorti le 14 août 2026, après GLM-5.2 / 5 / 5.1). Z.ai a rendu l'API 5.3 disponible (GA) le 19 août et publié les poids ouverts le 28 août ; via ChinaModelAPI, glm-5.2 / glm-5.1 continuent de fonctionner tandis que l'ID de relais glm-5.3 termine son contrôle de santé.

GLM-5.3 est-il open source ?

Oui — Zhipu a publié des poids ouverts sur Hugging Face (zai-org/GLM-5.3) le 28 août 2026 sous une licence glm-5.3 personnalisée (GLM-5.2 était sous MIT) ; l'API cloud reste la voie la plus simple via des passerelles compatibles OpenAI comme ChinaModelAPI.

Fenêtre de contexte ?

GLM-5.3 est commercialisé avec un solide contexte de 1M de tokens pour les travaux à long terme. Confirmez les limites en direct dans le tableau de bord de votre fournisseur.

GLM-5.3 vs Kimi K3 ?

Les deux sont des lignes frontier chinoises de 2026. GLM-5.3 est le modèle phare code/agents renforcé par post-entraînement ; Kimi K3 est le modèle phare multimodal de classe 2.8T et à contexte 1M de Moonshot. Comparez sur votre propre jeu d'évaluation.

Guides associés