ChinaModelAPI
Aggiornamento · 2026-08-28

GLM-5.3 è ora il modello di punta con pesi aperti: i pesi sono arrivati su Hugging Face il 28 ago (zai-org/GLM-5.3, licenza custom). API in GA dal 19 ago — $1,40 input / $4,40 output per 1M token ($0,26 cache), disponibile su OpenRouter dal 18 ago; indice Artificial Analysis 60 (rank 8/182). Breaking change dell'API: thinking.type: "disabled" non è più supportato e fallisce. Sul relay ChinaModelAPI, glm-5.2 / glm-5.1 continuano a risolvere mentre l'ID glm-5.3 completa l'health-check. Leggi il brief di rilascio →

Aggiornato il 2026-08-31 · Guida

API GLM-5.3 — Guida rapida al modello di punta Zhipu

GLM-5.3 è l'attuale modello di punta di Zhipu AI / Z.ai per coding e agenti a lungo termine — stessa base di GLM-5.2, con miglioramenti generalizzati dallo scaling post-training (Terminal-Bench 3.0 da 4,6 a 28,3), un solido contesto da 1M token e pesi aperti su Hugging Face dal 28 ago. Su ChinaModelAPI, gli ID glm-5.2 / glm-5.1 continuano a risolvere durante la transizione all'ID relay glm-5.3.

Risposta diretta (agosto 2026)

Attuale modello di punta di Zhipu = GLM-5.3 (rilasciato il 14 ago 2026 — stessa base di GLM-5.2, tutti i miglioramenti derivano dallo scaling post-training; Terminal-Bench 3.0 da 4,6 a 28,3, CyberGym 84,5%). Z.ai ha reso disponibile in GA l'API il 19 ago a $1,40 / $4,40 per 1M token ($0,26 cache) e ha pubblicato i pesi aperti il 28 ago (zai-org/GLM-5.3, licenza custom). ID di riferimento via ChinaModelAPI: glm-5.3 su https://api.chinamodelapi.com/v1, attivo al completamento dell'health-check del relay — nel frattempo glm-5.2 / glm-5.1 continuano a risolvere; conferma l'alias attivo nella dashboard. Superficie ufficiale del prodotto: z.ai / chat.z.ai. Novità anche per: GLM-5.3-Flash — pesi aperti a circa 1/10 del prezzo di punta.

Fonti: blog di Z.ai “GLM-5.3” (2026-08-14); blog di Z.ai “GLM-5.2: Built for Long-Horizon Tasks” (2026-06-16); rilascio dei pesi zai-org/GLM-5.3 su Hugging Face (2026-08-28).

Cosa è cambiato rispetto alle linee GLM precedenti

  • GLM-5.3 — attuale modello di punta (14 ago 2026): stessa base di 5.2, tutti i miglioramenti derivano dallo scaling post-training; Terminal-Bench 3.0 4.6→28.3, CyberGym 84,5%; pesi aperti dal 28 ago (licenza custom); il fratello GLM-5.3-Flash pubblica pesi aperti a ~1/10 del prezzo
  • GLM-5.2 — pesi aperti per SWE & agenti a lungo termine, contesto ~1M, pesi MIT; l'ID di produzione su ChinaModelAPI che continua a risolvere oggi
  • GLM-5.1 — passaggio 5.x precedente (ancora utile per test A/B su costi/latenza)
  • Le vecchie etichette di marketing come GLM-4.5 / 4-Plus sono superate per il posizionamento come “ultimo modello” — preferisci la linea 5.x (attuale modello di punta: GLM-5.3) nei testi promozionali del prodotto

Punti di forza

  • Cicli di coding multi-step lunghi / agenti in stile harness (Terminal-Bench 3.0 28.3)
  • Capacità di cybersecurity emergenti (CyberGym 84,5%) — da usare in modo responsabile
  • Qualità frontier open-weight competitiva a costi inferiori rispetto alle API chiuse statunitensi
  • Opzione self-host quando i dati devono restare on-premise (licenza custom glm-5.3)
  • L'UX di prodotto bilingue ZH/EN resta solida

Python

from openai import OpenAI
client = OpenAI(api_key="YOUR_KEY", base_url="https://api.chinamodelapi.com/v1")
resp = client.chat.completions.create(
    model="glm-5.3",
    messages=[
        {"role": "system", "content": "You are a senior software engineer. Plan then implement."},
        {"role": "user", "content": "Add retry + timeout to this HTTP client and write tests."},
    ],
    temperature=0.2,
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";
const client = new OpenAI({
  apiKey: process.env.CHINAMODELAPI_KEY,
  baseURL: "https://api.chinamodelapi.com/v1",
});
const resp = await client.chat.completions.create({
  model: "glm-5.3",
  messages: [{ role: "user", content: "Refactor this service for idempotent webhooks." }],
});
console.log(resp.choices[0].message.content);

Consiglio di routing

Indirizza il traffico di produzione per coding/agenti verso glm-5.3 al completamento dell'health-check dell'ID relay — nel frattempo glm-5.2 / glm-5.1 continuano a risolvere; conferma gli alias attivi nella tua dashboard. Mantieni la classificazione in blocco di testi brevi su ID più economici come il livello GLM-5.3-Flash. Per pacchetti multi-documento estremi, valuta anche Kimi K3.

FAQ

L'ultimo GLM è ancora 4.5?

No. L'attuale modello di punta di Zhipu è GLM-5.3 (rilasciato il 14 ago 2026, dopo GLM-5.2 / 5 / 5.1). Z.ai ha reso disponibile in GA l'API di 5.3 il 19 ago e ha pubblicato i pesi aperti il 28 ago; tramite ChinaModelAPI, glm-5.2 / glm-5.1 continuano a risolvere mentre l'ID relay glm-5.3 completa l'health-check.

GLM-5.3 è open source?

Sì — Zhipu ha pubblicato pesi aperti su Hugging Face (zai-org/GLM-5.3) il 28 ago 2026 con una licenza glm-5.3 custom (GLM-5.2 era MIT); l'API cloud rimane la soluzione più semplice tramite gateway compatibili con OpenAI come ChinaModelAPI.

Finestra di contesto?

GLM-5.3 viene promosso con un solido contesto da 1M token per attività a lungo termine. Verifica i limiti effettivi nella dashboard del tuo provider.

GLM-5.3 vs Kimi K3?

Entrambe sono linee frontier cinesi del 2026. GLM-5.3 è il modello di punta per coding/agenti potenziato dal post-training; Kimi K3 è il modello multimodale di punta da 2.8T e contesto 1M di Moonshot. Esegui benchmark sul tuo set di valutazione.

Guide correlate