ChinaModelAPI

Notizie / Model Watch · Rilascio open-weight

Pesi aperti Top di gamma GLM-5.3 141 shard + BF16 licenza personalizzata glm-5.3
2026-08-29 · Model Watch · caricato il 28 ago ~23:22 ora di Pechino, nei tempi promessi

I pesi aperti di GLM-5.3 arrivano puntuali: il top di gamma del post-training scaling è ora scaricabile

Zhipu ha chiuso il cerchio aperto il 14 ago: i pesi del modello di punta GLM-5.3 sono approdati su zai-org la notte del 28 ago — all'interno della finestra di circa due settimane promessa per la revisione della sicurezza, tre giorni dopo la versione gemella Flash. Il titolo stesso della scheda: "Frontier Coding with Emergent Cyber Capabilities."

Risposta diretta

I pesi del modello di punta GLM-5.3 sono disponibili: zai-org/GLM-5.3, 141 shard safetensors + variante BF16, accesso libero, caricamento completato alle ~23:22 di Pechino il 28 ago (ultimo aggiornamento repo, verificato via API). La licenza è personalizzata, denominata "glm-5.3" — leggere il file LICENSE prima dell'hosting autonomo commerciale. Stessa base di GLM-5.2 con tutti i miglioramenti derivanti dal post-training (Terminal-Bench 3.0 4.6→28.3, AA Index 60, co-#1 open source); API già in GA dal 19 ago a $1.40/$4.40.

Cosa è stato rilasciato (verificato via API)

  • Il repository. 153 file totali, 141 shard safetensors, oltre a un repository separato GLM-5.3-BF16; senza restrizioni d'accesso. La pagina HF mostra ancora un banner "Upcoming release" in alcune visualizzazioni — un artefatto del template della pagina; l'API dei file conferma che gli artefatti sono disponibili e scaricabili.
  • Licenza. Personalizzata, license_name "glm-5.3" (campo: other) — non Apache 2.0. La versione gemella Flash include termini propri; verificare entrambi i file LICENSE per le clausole di proprio interesse.
  • Tempistiche, esattamente come promesso. "Pesi in ~due settimane" (dichiarato il 14 ago) → Flash in anticipo (26-27 ago, tramite il reveal di Ox Alpha) → modello di punta nella finestra del 28 ago. Il thread su HN "GLM-5.3 is now open-weight": 537 punti e in crescita.
  • Posizionamento. Il titolo ufficiale della scheda — "Frontier Coding with Emergent Cyber Capabilities" — punta sulla narrazione della sicurezza difensiva (2.436 vulnerabilità reali individuate, rilascio scaglionato per la revisione della sicurezza) che ha caratterizzato questo ciclo di lancio.

Quali pesi di GLM-5.3 dovresti scaricare?

Il tuo carico di lavoroScaricaPerché
Massima intelligenza, coding + cyber + agenti a lungo raggio (piattaforma di inferenza)GLM-5.3 (modello di punta)La stella del post-training scaling; co-#1 open source con AA 60; serving di livello datacenter
Multimodale (input immagini/video) a circa 1/10 del costoGLM-5.3-Flash320B/A18B, primo modello nativamente multimodale della serie GLM-5; quantizzazioni locali disponibili
API gestita, nessuna infrastrutturadocs.z.ai GA$1.40/$4.44 per 1M dal 19 ago; l'instradamento relay di glm-5.3 segue l'health-check

Specifiche di Flash secondo la scheda ufficiale (320B/18B attivi); classe di parametri del modello di punta secondo i report del ciclo di lancio (~744B MoE) — verificare nella configurazione del repository prima del capacity planning.

La frontiera open-weight, completata

Con il rilascio di questa sera, l'attuale modello di punta di ogni principale laboratorio cinese è scaricabile entro poche settimane dal lancio: Qwen3.8-Max (2.4T, oltre ad Apache 27B e all'esploratore di architettura Flash-Next), Kimi K3 (2.8T — già sottoposto a post-training in Harvey Tenet), e ora GLM-5.3 + Flash. Il divario tra modelli di frontiera e open source che ha caratterizzato il 2025 si è, almeno in questo trimestre, completamente colmato sul fronte cinese.

Fonti primarie

Domande frequenti (2026)

I pesi sono davvero disponibili?

Sì — 141 shard + BF16 su zai-org, caricamento completato alle ~23:22 di Pechino il 28 ago (verificato via API), accesso libero. Annuncio su HN a quota 500+ punti.

Licenza?

Personalizzata, denominata "glm-5.3" (non Apache). Leggere il file LICENSE prima dell'hosting autonomo commerciale; Flash prevede condizioni proprie.

vs GLM-5.2?

Stessa base, tutti i miglioramenti derivano dal post-training: Terminal-Bench 3.0 4.6→28.3, CyberGym 84.5%, AA 60 (co-#1 open source). Breaking change: rimosso thinking.type 'disabled'.

vs GLM-5.3-Flash?

Modello di punta = massima intelligenza (classe ~744B, orientato al testo). Flash = 320B/A18B nativamente multimodale a ~1/10 del prezzo, quantizzazioni locali. Casi d'uso differenti.

Usare invece l'API?

In GA dal 19 ago — $1.40/$4.40 per 1M su docs.z.ai; ZCode, Coding Plan, PhanRouter, JD Cloud e la piattaforma di supercalcolo lo supportano tutti.

Cosa completa questo rilascio?

Il catalogo open-weight cinese: Qwen3.8-Max/27B/Flash-Next, Kimi K3, GLM-5.3+Flash — ogni attuale modello di punta scaricabile entro poche settimane dal lancio.

Guide correlate