ChinaModelAPI

News / Model Watch · Open-Weights-Release

Open Weights GLM-5.3 Flaggschiff 141 Shards + BF16 Eigene glm-5.3-Lizenz
2026-08-29 · Model Watch · hochgeladen am 28. Aug. ~23:22 Peking, im versprochenen Zeitfenster

GLM-5.3 Open Weights landen nach Zeitplan: Das Post-Training-Scaling-Flaggschiff steht zum Download bereit

Zhipu schloss den Kreis, der am 14. Aug. begonnen wurde: Die GLM-5.3-Flaggschiff-Gewichte erschienen in der Nacht des 28. Aug. auf zai-org – innerhalb des versprochenen rund zweiwöchigen Sicherheitsprüfungs-Fensters, drei Tage nach dem Flash-Geschwistermodell. Die eigene Überschrift der Modellkarte: "Frontier Coding with Emergent Cyber Capabilities."

Direkte Antwort

GLM-5.3-Flaggschiff-Gewichte sind live: zai-org/GLM-5.3, 141 Safetensors-Shards + BF16-Variante, ungated, Upload abgeschlossen um ~23:22 Peking am 28. Aug. (Repo zuletzt geändert, API-verifiziert). Lizenz ist benutzerdefiniert, genannt "glm-5.3" – lesen Sie vor dem kommerziellen Self-Hosting die LICENSE-Datei. Gleiche Basis wie GLM-5.2 mit allen Verbesserungen aus dem Post-Training (Terminal-Bench 3.0 4.6→28.3, AA Index 60, Open-Source geteilter Platz 1); API bereits GA seit 19. Aug. für $1.40/$4.40.

Was veröffentlicht wurde (API-verifiziert)

  • Das Repo. Insgesamt 153 Dateien, 141 Safetensors-Shards sowie ein separates GLM-5.3-BF16-Repo; ungated. Die HF-Seite zeigt in einigen Ansichten noch ein „Upcoming release“-Banner – ein Artefakt der Seitenvorlage; die Dateien-API bestätigt, dass die Artefakte live und herunterladbar sind.
  • Lizenz. Benutzerdefiniert, license_name "glm-5.3" (Feld: other) – nicht Apache 2.0. Das Flash-Geschwistermodell bringt eigene Bedingungen mit; prüfen Sie beide LICENSE-Dateien auf die für Sie relevanten Klauseln.
  • Timing, genau wie versprochen. "Gewichte in ~zwei Wochen" (angekündigt am 14. Aug.) → Flash vorzeitig (26.–27. Aug., über die Ox Alpha-Enthüllung) → Flaggschiff im Zeitfenster des 28. Aug. Der HN-Thread "GLM-5.3 is now open-weight": 537 Punkte und steigend.
  • Positionierung. Die offizielle Überschrift der Modellkarte – "Frontier Coding with Emergent Cyber Capabilities" – setzt auf den Schwerpunkt defensive Sicherheit (2.436 echte Schwachstellen gefunden, gestaffelte Veröffentlichung zur Sicherheitsprüfung), der diesen Release-Zyklus geprägt hat.

Welche GLM-5.3-Gewichte sollten Sie herunterladen?

Ihr WorkloadDownloadWarum
Maximale Intelligenz, Coding + Cyber + Long-Horizon-Agenten (Inferenz-Plattform)GLM-5.3 (Flaggschiff)Der Star des Post-Training-Scalings; AA 60 Open-Source geteilter Platz 1; Serving auf Rechenzentrumsniveau
Multimodal (Bild/Video-Input) zu etwa 1/10 der KostenGLM-5.3-Flash320B/A18B, erstes natives multimodales Modell der GLM-5-Serie; lokale Quantisierungen verfügbar
Gehostete API, keine Infrastrukturdocs.z.ai GA$1.40/$4.44 pro 1M seit 19. Aug.; glm-5.3-Relay-Routing folgt Health-Check

Flash-Spezifikationen laut offizieller Modellkarte (320B/18B aktiv); Flaggschiff-Parameterklasse laut Berichten des Release-Zyklus (~744B MoE) – vor der Kapazitätsplanung in der Repo-Konfiguration überprüfen.

Die Open-Weight-Frontier, komplettiert

Mit dem heutigen Release ist das aktuelle Flaggschiff jedes großen chinesischen KI-Labors innerhalb weniger Wochen nach Launch herunterladbar: Qwen3.8-Max (2.4T, plus Apache 27B und der Flash-Next-Architektur-Scout), Kimi K3 (2.8T – bereits durch Post-Training zu Harvey Tenet weiterentwickelt) und jetzt GLM-5.3 + Flash. Die Kluft zwischen Frontier- und Open-Modellen, die 2025 definierte, hat sich – zumindest in diesem Quartal – von chinesischer Seite vollständig geschlossen.

Primärquellen

Häufig gestellte Fragen (2026)

Sind die Gewichte wirklich verfügbar?

Ja – 141 Shards + BF16 auf zai-org, Upload abgeschlossen um ~23:22 Peking am 28. Aug. (API-verifiziert), ungated. HN-Ankündigung bei 500+ Punkten.

Lizenz?

Benutzerdefiniert, genannt "glm-5.3" (nicht Apache). Vor dem kommerziellen Self-Hosting die LICENSE-Datei lesen; Flash hat eigene Bedingungen.

vs. GLM-5.2?

Gleiche Basis, alle Fortschritte durch Post-Training: Terminal-Bench 3.0 4.6→28.3, CyberGym 84.5%, AA 60 (Open-Source geteilter Platz 1). Breaking Change: thinking.type 'disabled' entfernt.

vs. GLM-5.3-Flash?

Flaggschiff = maximale Intelligenz (~744B-Klasse, Text-fokussiert). Flash = 320B/A18B nativ multimodal zu etwa 1/10 des Preises, lokale Quantisierungen. Unterschiedliche Aufgaben.

API stattdessen?

GA seit 19. Aug. – $1.40/$4.40 pro 1M auf docs.z.ai; ZCode, Coding Plan, PhanRouter, JD Cloud und die Supercomputing-Plattform stellen es alle bereit.

Was wird damit komplettiert?

Das chinesische Open-Weight-Portfolio: Qwen3.8-Max/27B/Flash-Next, Kimi K3, GLM-5.3+Flash – jedes aktuelle Flaggschiff innerhalb weniger Wochen nach Launch zum Download bereit.

Verwandte Leitfäden