News / Model Watch · Open-Weights-Release
GLM-5.3 Open Weights landen nach Zeitplan: Das Post-Training-Scaling-Flaggschiff steht zum Download bereit
Zhipu schloss den Kreis, der am 14. Aug. begonnen wurde: Die GLM-5.3-Flaggschiff-Gewichte erschienen in der Nacht des 28. Aug. auf zai-org – innerhalb des versprochenen rund zweiwöchigen Sicherheitsprüfungs-Fensters, drei Tage nach dem Flash-Geschwistermodell. Die eigene Überschrift der Modellkarte: "Frontier Coding with Emergent Cyber Capabilities."
GLM-5.3-Flaggschiff-Gewichte sind live: zai-org/GLM-5.3, 141 Safetensors-Shards + BF16-Variante, ungated, Upload abgeschlossen um ~23:22 Peking am 28. Aug. (Repo zuletzt geändert, API-verifiziert). Lizenz ist benutzerdefiniert, genannt "glm-5.3" – lesen Sie vor dem kommerziellen Self-Hosting die LICENSE-Datei. Gleiche Basis wie GLM-5.2 mit allen Verbesserungen aus dem Post-Training (Terminal-Bench 3.0 4.6→28.3, AA Index 60, Open-Source geteilter Platz 1); API bereits GA seit 19. Aug. für $1.40/$4.40.
Was veröffentlicht wurde (API-verifiziert)
- Das Repo. Insgesamt 153 Dateien, 141 Safetensors-Shards sowie ein separates
GLM-5.3-BF16-Repo; ungated. Die HF-Seite zeigt in einigen Ansichten noch ein „Upcoming release“-Banner – ein Artefakt der Seitenvorlage; die Dateien-API bestätigt, dass die Artefakte live und herunterladbar sind. - Lizenz. Benutzerdefiniert, license_name "glm-5.3" (Feld: other) – nicht Apache 2.0. Das Flash-Geschwistermodell bringt eigene Bedingungen mit; prüfen Sie beide LICENSE-Dateien auf die für Sie relevanten Klauseln.
- Timing, genau wie versprochen. "Gewichte in ~zwei Wochen" (angekündigt am 14. Aug.) → Flash vorzeitig (26.–27. Aug., über die Ox Alpha-Enthüllung) → Flaggschiff im Zeitfenster des 28. Aug. Der HN-Thread "GLM-5.3 is now open-weight": 537 Punkte und steigend.
- Positionierung. Die offizielle Überschrift der Modellkarte – "Frontier Coding with Emergent Cyber Capabilities" – setzt auf den Schwerpunkt defensive Sicherheit (2.436 echte Schwachstellen gefunden, gestaffelte Veröffentlichung zur Sicherheitsprüfung), der diesen Release-Zyklus geprägt hat.
Welche GLM-5.3-Gewichte sollten Sie herunterladen?
| Ihr Workload | Download | Warum |
|---|---|---|
| Maximale Intelligenz, Coding + Cyber + Long-Horizon-Agenten (Inferenz-Plattform) | GLM-5.3 (Flaggschiff) | Der Star des Post-Training-Scalings; AA 60 Open-Source geteilter Platz 1; Serving auf Rechenzentrumsniveau |
| Multimodal (Bild/Video-Input) zu etwa 1/10 der Kosten | GLM-5.3-Flash | 320B/A18B, erstes natives multimodales Modell der GLM-5-Serie; lokale Quantisierungen verfügbar |
| Gehostete API, keine Infrastruktur | docs.z.ai GA | $1.40/$4.44 pro 1M seit 19. Aug.; glm-5.3-Relay-Routing folgt Health-Check |
Flash-Spezifikationen laut offizieller Modellkarte (320B/18B aktiv); Flaggschiff-Parameterklasse laut Berichten des Release-Zyklus (~744B MoE) – vor der Kapazitätsplanung in der Repo-Konfiguration überprüfen.
Die Open-Weight-Frontier, komplettiert
Mit dem heutigen Release ist das aktuelle Flaggschiff jedes großen chinesischen KI-Labors innerhalb weniger Wochen nach Launch herunterladbar: Qwen3.8-Max (2.4T, plus Apache 27B und der Flash-Next-Architektur-Scout), Kimi K3 (2.8T – bereits durch Post-Training zu Harvey Tenet weiterentwickelt) und jetzt GLM-5.3 + Flash. Die Kluft zwischen Frontier- und Open-Modellen, die 2025 definierte, hat sich – zumindest in diesem Quartal – von chinesischer Seite vollständig geschlossen.
Primärquellen
- Hugging Face — zai-org/GLM-5.3 Offizielles Repository (141 Shards + LICENSE, Upload abgeschlossen am 28.08. um 23:22 Peking)
- Hugging Face — zai-org/GLM-5.3-Flash (Geschwistermodell: 320B/A18B nativ multimodal)
- Hacker News — "GLM-5.3 is now open-weight" (537 Punkte)
- Z.ai Offizieller Blog — GLM-5.3 Release und Zugang zum technischen Bericht
- Chronologie: 14. Aug. Ankündigung → 19. Aug. API GA → Ox Alpha / Flash-Enthüllung → Gewichte dieses Modells veröffentlicht
Häufig gestellte Fragen (2026)
Sind die Gewichte wirklich verfügbar?
Ja – 141 Shards + BF16 auf zai-org, Upload abgeschlossen um ~23:22 Peking am 28. Aug. (API-verifiziert), ungated. HN-Ankündigung bei 500+ Punkten.
Lizenz?
Benutzerdefiniert, genannt "glm-5.3" (nicht Apache). Vor dem kommerziellen Self-Hosting die LICENSE-Datei lesen; Flash hat eigene Bedingungen.
vs. GLM-5.2?
Gleiche Basis, alle Fortschritte durch Post-Training: Terminal-Bench 3.0 4.6→28.3, CyberGym 84.5%, AA 60 (Open-Source geteilter Platz 1). Breaking Change: thinking.type 'disabled' entfernt.
vs. GLM-5.3-Flash?
Flaggschiff = maximale Intelligenz (~744B-Klasse, Text-fokussiert). Flash = 320B/A18B nativ multimodal zu etwa 1/10 des Preises, lokale Quantisierungen. Unterschiedliche Aufgaben.
API stattdessen?
GA seit 19. Aug. – $1.40/$4.40 pro 1M auf docs.z.ai; ZCode, Coding Plan, PhanRouter, JD Cloud und die Supercomputing-Plattform stellen es alle bereit.
Was wird damit komplettiert?
Das chinesische Open-Weight-Portfolio: Qwen3.8-Max/27B/Flash-Next, Kimi K3, GLM-5.3+Flash – jedes aktuelle Flaggschiff innerhalb weniger Wochen nach Launch zum Download bereit.