ChinaModelAPI
Update · 2026-08-28

GLM-5.3 ist jetzt das Open-Weights-Flaggschiff: Die Gewichte sind am 28. Aug. auf Hugging Face gelandet (zai-org/GLM-5.3, eigene Lizenz). API seit 19. Aug. in GA — $1,40 Input / $4,40 Output pro 1M Tokens ($0,26 gecacht), seit 18. Aug. auf OpenRouter; Artificial-Analysis-Index 60 (Rang 8/182). Breaking Change der API: thinking.type: "disabled" wird nicht mehr unterstützt und schlägt fehl. Auf dem ChinaModelAPI-Relay bleiben glm-5.2 / glm-5.1 auflösbar, während die glm-5.3-ID den Health-Check abschließt. Release-Brief lesen →

Aktualisiert 2026-08-31 · Leitfaden

GLM-5.3 API — Zhipu-Flaggschiff Schnellstart

GLM-5.3 ist das aktuelle Flaggschiff von Zhipu AI / Z.ai für Long-Horizon-Coding & Agents — dieselbe Basis wie GLM-5.2, mit flächendeckenden Gewinnen durch Post-Training-Skalierung (Terminal-Bench 3.0 von 4,6 auf 28,3), solidem 1M-Token-Kontext und offenen Gewichten auf Hugging Face seit dem 28. Aug. Auf ChinaModelAPI bleiben die IDs glm-5.2 / glm-5.1 auflösbar, während der Übergang zur Relay-ID glm-5.3 läuft.

Direkte Antwort (August 2026)

Aktuelles Flaggschiff von Zhipu = GLM-5.3 (veröffentlicht am 14. Aug. 2026 — dieselbe Basis wie GLM-5.2, alle Verbesserungen durch Post-Training-Skalierung; Terminal-Bench 3.0 von 4,6 auf 28,3, CyberGym 84,5%). Z.ai hat die API am 19. Aug. in GA freigegeben ($1,40 / $4,40 pro 1M Tokens, $0,26 gecacht) und am 28. Aug. offene Gewichte veröffentlicht (zai-org/GLM-5.3, eigene Lizenz). Ziel-ID über ChinaModelAPI: glm-5.3 auf https://api.chinamodelapi.com/v1, live sobald der Relay-Health-Check abgeschlossen ist — bis dahin bleiben glm-5.2 / glm-5.1 auflösbar; bestätigen Sie den Live-Alias im Dashboard. Offizielle Produktoberfläche: z.ai / chat.z.ai. Ebenfalls neu: GLM-5.3-Flash — offene Gewichte zu rund 1/10 des Flaggschiff-Preises.

Quellen: Z.ai-Blog „GLM-5.3“ (2026-08-14); Z.ai-Blog „GLM-5.2: Built for Long-Horizon Tasks“ (2026-06-16); Release der Gewichte zai-org/GLM-5.3 auf Hugging Face (2026-08-28).

Was sich gegenüber älteren GLM-Reihen geändert hat

  • GLM-5.3 — aktuelles Flaggschiff (14. Aug. 2026): dieselbe Basis wie 5.2, alle Verbesserungen durch Post-Training-Skalierung; Terminal-Bench 3.0 4.6→28.3, CyberGym 84,5%; Gewichte seit 28. Aug. offen (eigene Lizenz); das Schwestermodell GLM-5.3-Flash veröffentlicht offene Gewichte zu ~1/10 des Preises
  • GLM-5.2 — Open-Weights für Long-Horizon-SWE & Agenten, ~1M Kontext, MIT-Gewichte; die Produktions-ID auf ChinaModelAPI, die heute weiterhin auflöst
  • GLM-5.1 — vorheriger 5.x-Schritt (weiterhin nützlich für Kosten-/Latenz-A/B-Tests)
  • Ältere Marketingbezeichnungen wie GLM-4.5 / 4-Plus sind für die Positionierung als „neueste Version“ überholt — bevorzugen Sie in Produkttexten die 5.x-Reihe (aktuelles Flaggschiff: GLM-5.3)

Stärken

  • Lange mehrstufige Coding-Schleifen / Harness-artige Agenten (Terminal-Bench 3.0: 28,3)
  • Emergente Cybersicherheitsfähigkeiten (CyberGym 84,5%) — verantwortungsvoll einsetzen
  • Konkurrenzfähige Open-Weights-Frontier-Qualität zu niedrigeren Kosten als geschlossene US-APIs
  • Self-Host-Option, wenn Daten on-premise bleiben müssen (eigene glm-5.3-Lizenz)
  • Zweisprachige ZH/EN-Produkt-UX bleibt stark

Python

from openai import OpenAI
client = OpenAI(api_key="YOUR_KEY", base_url="https://api.chinamodelapi.com/v1")
resp = client.chat.completions.create(
    model="glm-5.3",
    messages=[
        {"role": "system", "content": "You are a senior software engineer. Plan then implement."},
        {"role": "user", "content": "Add retry + timeout to this HTTP client and write tests."},
    ],
    temperature=0.2,
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";
const client = new OpenAI({
  apiKey: process.env.CHINAMODELAPI_KEY,
  baseURL: "https://api.chinamodelapi.com/v1",
});
const resp = await client.chat.completions.create({
  model: "glm-5.3",
  messages: [{ role: "user", content: "Refactor this service for idempotent webhooks." }],
});
console.log(resp.choices[0].message.content);

Routing-Tipp

Leiten Sie produktiven Coding-/Agenten-Traffic standardmäßig an glm-5.3, sobald die Relay-ID den Health-Check abgeschlossen hat — bis dahin bleiben glm-5.2 / glm-5.1 auflösbar; bestätigen Sie Live-Aliasse im Dashboard. Für kurze Massenklassifizierungen nutzen Sie günstigere IDs wie die GLM-5.3-Flash-Stufe. Für extreme Multi-Dokument-Pakete evaluieren Sie auch Kimi K3.

FAQ

Ist das neueste GLM immer noch 4.5?

Nein. Das aktuelle Flaggschiff von Zhipu ist GLM-5.3 (veröffentlicht am 14. Aug. 2026, nach GLM-5.2 / 5 / 5.1). Z.ai hat die 5.3-API am 19. Aug. allgemein freigegeben (GA) und am 28. Aug. offene Gewichte veröffentlicht; über ChinaModelAPI bleiben glm-5.2 / glm-5.1 auflösbar, während die Relay-ID glm-5.3 den Health-Check abschließt.

Ist GLM-5.3 Open Source?

Ja — Zhipu hat am 28. Aug. 2026 offene Gewichte auf Hugging Face (zai-org/GLM-5.3) unter einer eigenen glm-5.3-Lizenz veröffentlicht (GLM-5.2 kam als MIT); die Cloud-API bleibt der einfache Weg über OpenAI-kompatible Gateways wie ChinaModelAPI.

Kontextfenster?

GLM-5.3 wird mit einem soliden 1M-Token-Kontext für Long-Horizon-Aufgaben beworben. Überprüfen Sie die aktuellen Limits in Ihrem Provider-Dashboard.

GLM-5.3 vs. Kimi K3?

Beide sind chinesische Frontier-Linien von 2026. GLM-5.3 ist das durch Post-Training skalierte Coding-/Agenten-Flaggschiff; Kimi K3 ist Moonshots multimodales 2.8T-Klasse-Flaggschiff mit 1M-Kontext. Benchmarken Sie mit Ihrem eigenen Eval-Set.

Verwandte Leitfäden