Actualités / Model Watch · Sortie des poids ouverts
Les poids ouverts de GLM-5.3 arrivent dans les délais : le modèle phare du post-training scaling devient téléchargeable
Zhipu a bouclé la boucle ouverte le 14 août : les poids du modèle phare GLM-5.3 sont arrivés sur zai-org dans la nuit du 28 août — dans le délai promis d'environ deux semaines pour la revue de sécurité, trois jours après son homologue Flash. Le titre officiel de la fiche : "Frontier Coding with Emergent Cyber Capabilities."
Les poids du modèle phare GLM-5.3 sont en ligne : zai-org/GLM-5.3, 141 shards safetensors + variante BF16, accès libre, téléversement terminé vers 23:22 (heure de Pékin) le 28 août (dernière modification du dépôt, vérifiée par API). La licence est personnalisée, nommée "glm-5.3" — lisez le fichier LICENSE avant tout auto-hébergement commercial. Même base que GLM-5.2 avec tous les gains issus du post-training (Terminal-Bench 3.0 4.6→28.3, AA Index 60, co-n°1 open-source) ; API déjà en GA depuis le 19 août à $1.40/$4.40.
Ce qui a été publié (vérifié par API)
- Le dépôt. 153 fichiers au total, 141 shards safetensors, plus un dépôt
GLM-5.3-BF16séparé ; non restreint. La page HF affiche encore une bannière "Upcoming release" dans certaines vues — un artefact du modèle de page ; l'API des fichiers confirme que les artefacts sont bien en ligne et téléchargeables. - Licence. Personnalisée, license_name "glm-5.3" (champ : other) — pas Apache 2.0. La version Flash applique ses propres conditions ; consultez les deux fichiers LICENSE pour les clauses qui vous concernent.
- Calendrier, exactement comme promis. "Poids d'ici environ deux semaines" (annoncé le 14 août) → Flash en avance (26-27 août, via la révélation d'Ox Alpha) → modèle phare dans le créneau du 28 août. Fil Hacker News "GLM-5.3 is now open-weight" : 537 points et en progression.
- Positionnement. Le titre officiel de la fiche — "Frontier Coding with Emergent Cyber Capabilities" — met l'accent sur le volet sécurité défensive (2 436 vulnérabilités réelles découvertes, déploiement par étapes pour revue de sécurité) qui a défini ce cycle de lancement.
Quels poids de GLM-5.3 devriez-vous télécharger ?
| Votre charge de travail | Télécharger | Pourquoi |
|---|---|---|
| Intelligence maximale, code + cyber + agents long terme (plateforme d'inférence) | GLM-5.3 (modèle phare) | La vedette du post-training scaling ; AA 60 co-n°1 open-source ; hébergement de classe datacenter |
| Multimodal (entrée image/vidéo) à environ 1/10 du coût | GLM-5.3-Flash | 320B/A18B, premier modèle nativement multimodal de la série GLM-5 ; quantifications locales disponibles |
| API hébergée, sans infrastructure | docs.z.ai GA | $1.40/$4.44 par million depuis le 19 août ; le routage relais de glm-5.3 suit le health-check |
Spécifications de Flash selon sa fiche officielle (320B/18B actifs) ; classe de paramètres du modèle phare selon les rapports du cycle de lancement (~744B MoE) — à confirmer dans la configuration du dépôt avant la planification des capacités.
La frontière des poids ouverts, au complet
Avec la sortie de ce soir, le modèle phare actuel de chaque grand laboratoire chinois est téléchargeable quelques semaines après son lancement : Qwen3.8-Max (2.4T, plus Apache 27B et l'éclaireur d'architecture Flash-Next), Kimi K3 (2.8T — déjà post-entraîné en Harvey Tenet), et maintenant GLM-5.3 + Flash. L'écart entre modèles frontier et ouverts qui a marqué 2025 s'est, du moins ce trimestre, entièrement comblé du côté chinois.
Sources primaires
- Hugging Face — Dépôt officiel zai-org/GLM-5.3 (141 shards + LICENSE, téléversement terminé le 28/08 à 23:22 heure de Pékin)
- Hugging Face — zai-org/GLM-5.3-Flash (modèle associé : 320B/A18B nativement multimodal)
- Hacker News — "GLM-5.3 is now open-weight" (537 points)
- Blog officiel de Z.ai — Lancement de GLM-5.3 et accès au rapport technique
- Chronologie : lancement le 14 août → 19 août API GA → Révélation d'Ox Alpha / Flash → Sortie des poids
Questions fréquentes (2026)
Les poids sont-ils vraiment sortis ?
Oui — 141 shards + BF16 sur zai-org, téléversement terminé vers 23:22 (heure de Pékin) le 28 août (vérifié par API), accès libre. Annonce sur HN à plus de 500 points.
Licence ?
Personnalisée, nommée "glm-5.3" (pas Apache). Lisez le fichier LICENSE avant tout auto-hébergement commercial ; Flash a ses propres conditions.
vs GLM-5.2 ?
Même base, tous les gains viennent du post-training : Terminal-Bench 3.0 4.6→28.3, CyberGym 84.5%, AA 60 (co-n°1 open-source). Changement cassant : thinking.type 'disabled' supprimé.
vs GLM-5.3-Flash ?
Modèle phare = intelligence maximale (classe ~744B, axé texte). Flash = 320B/A18B nativement multimodal à ~1/10 du prix, quantifications locales. Rôles différents.
Plutôt utiliser l'API ?
En GA depuis le 19 août — $1.40/$4.40 par million sur docs.z.ai ; ZCode, Coding Plan, PhanRouter, JD Cloud, plateforme de supercalcul le proposent tous.
Qu'est-ce que cela vient compléter ?
Le catalogue chinois des poids ouverts : Qwen3.8-Max/27B/Flash-Next, Kimi K3, GLM-5.3+Flash — chaque modèle phare actuel disponible au téléchargement quelques semaines après sa sortie.