Notizie / Model Watch · Rilascio open-weight
I pesi aperti di GLM-5.3 arrivano puntuali: il top di gamma del post-training scaling è ora scaricabile
Zhipu ha chiuso il cerchio aperto il 14 ago: i pesi del modello di punta GLM-5.3 sono approdati su zai-org la notte del 28 ago — all'interno della finestra di circa due settimane promessa per la revisione della sicurezza, tre giorni dopo la versione gemella Flash. Il titolo stesso della scheda: "Frontier Coding with Emergent Cyber Capabilities."
I pesi del modello di punta GLM-5.3 sono disponibili: zai-org/GLM-5.3, 141 shard safetensors + variante BF16, accesso libero, caricamento completato alle ~23:22 di Pechino il 28 ago (ultimo aggiornamento repo, verificato via API). La licenza è personalizzata, denominata "glm-5.3" — leggere il file LICENSE prima dell'hosting autonomo commerciale. Stessa base di GLM-5.2 con tutti i miglioramenti derivanti dal post-training (Terminal-Bench 3.0 4.6→28.3, AA Index 60, co-#1 open source); API già in GA dal 19 ago a $1.40/$4.40.
Cosa è stato rilasciato (verificato via API)
- Il repository. 153 file totali, 141 shard safetensors, oltre a un repository separato
GLM-5.3-BF16; senza restrizioni d'accesso. La pagina HF mostra ancora un banner "Upcoming release" in alcune visualizzazioni — un artefatto del template della pagina; l'API dei file conferma che gli artefatti sono disponibili e scaricabili. - Licenza. Personalizzata, license_name "glm-5.3" (campo: other) — non Apache 2.0. La versione gemella Flash include termini propri; verificare entrambi i file LICENSE per le clausole di proprio interesse.
- Tempistiche, esattamente come promesso. "Pesi in ~due settimane" (dichiarato il 14 ago) → Flash in anticipo (26-27 ago, tramite il reveal di Ox Alpha) → modello di punta nella finestra del 28 ago. Il thread su HN "GLM-5.3 is now open-weight": 537 punti e in crescita.
- Posizionamento. Il titolo ufficiale della scheda — "Frontier Coding with Emergent Cyber Capabilities" — punta sulla narrazione della sicurezza difensiva (2.436 vulnerabilità reali individuate, rilascio scaglionato per la revisione della sicurezza) che ha caratterizzato questo ciclo di lancio.
Quali pesi di GLM-5.3 dovresti scaricare?
| Il tuo carico di lavoro | Scarica | Perché |
|---|---|---|
| Massima intelligenza, coding + cyber + agenti a lungo raggio (piattaforma di inferenza) | GLM-5.3 (modello di punta) | La stella del post-training scaling; co-#1 open source con AA 60; serving di livello datacenter |
| Multimodale (input immagini/video) a circa 1/10 del costo | GLM-5.3-Flash | 320B/A18B, primo modello nativamente multimodale della serie GLM-5; quantizzazioni locali disponibili |
| API gestita, nessuna infrastruttura | docs.z.ai GA | $1.40/$4.44 per 1M dal 19 ago; l'instradamento relay di glm-5.3 segue l'health-check |
Specifiche di Flash secondo la scheda ufficiale (320B/18B attivi); classe di parametri del modello di punta secondo i report del ciclo di lancio (~744B MoE) — verificare nella configurazione del repository prima del capacity planning.
La frontiera open-weight, completata
Con il rilascio di questa sera, l'attuale modello di punta di ogni principale laboratorio cinese è scaricabile entro poche settimane dal lancio: Qwen3.8-Max (2.4T, oltre ad Apache 27B e all'esploratore di architettura Flash-Next), Kimi K3 (2.8T — già sottoposto a post-training in Harvey Tenet), e ora GLM-5.3 + Flash. Il divario tra modelli di frontiera e open source che ha caratterizzato il 2025 si è, almeno in questo trimestre, completamente colmato sul fronte cinese.
Fonti primarie
- Hugging Face — Repository ufficiale zai-org/GLM-5.3 (141 shard + LICENSE, caricamento completato il 28-08 alle 23:22 ora di Pechino)
- Hugging Face — zai-org/GLM-5.3-Flash (versione gemella: 320B/A18B nativamente multimodale)
- Hacker News — "GLM-5.3 is now open-weight" (537 punti)
- Blog ufficiale Z.ai — Lancio di GLM-5.3 e accesso al report tecnico
- Cronologia: Annuncio il 14 ago → 19 ago API GA → Presentazione di Ox Alpha / Flash → Disponibilità dei pesi
Domande frequenti (2026)
I pesi sono davvero disponibili?
Sì — 141 shard + BF16 su zai-org, caricamento completato alle ~23:22 di Pechino il 28 ago (verificato via API), accesso libero. Annuncio su HN a quota 500+ punti.
Licenza?
Personalizzata, denominata "glm-5.3" (non Apache). Leggere il file LICENSE prima dell'hosting autonomo commerciale; Flash prevede condizioni proprie.
vs GLM-5.2?
Stessa base, tutti i miglioramenti derivano dal post-training: Terminal-Bench 3.0 4.6→28.3, CyberGym 84.5%, AA 60 (co-#1 open source). Breaking change: rimosso thinking.type 'disabled'.
vs GLM-5.3-Flash?
Modello di punta = massima intelligenza (classe ~744B, orientato al testo). Flash = 320B/A18B nativamente multimodale a ~1/10 del prezzo, quantizzazioni locali. Casi d'uso differenti.
Usare invece l'API?
In GA dal 19 ago — $1.40/$4.40 per 1M su docs.z.ai; ZCode, Coding Plan, PhanRouter, JD Cloud e la piattaforma di supercalcolo lo supportano tutti.
Cosa completa questo rilascio?
Il catalogo open-weight cinese: Qwen3.8-Max/27B/Flash-Next, Kimi K3, GLM-5.3+Flash — ogni attuale modello di punta scaricabile entro poche settimane dal lancio.