ChinaModelAPI

Notizie / Model Watch · Osservatorio modelli misteriosi

Confermato ufficialmente Ox Alpha / 牛来 Contesto da 1M · settimana gratuita = GLM-5.3-Flash
2026-08-25 · aggiornato la sera del 2026-08-26 · mistero svelato: Zhipu conferma GLM-5.3-Flash, pesi stasera

Svelato Ox Alpha: Zhipu conferma che è GLM-5.3-Flash — Rilascio ufficiale e pesi aperti stasera

Un modello anonimo approda su OpenRouter con 1M di contesto, input immagini+video e una settimana gratuita — per poi superare Claude Fable 5 nei primi test a campione, attirare nei commenti il CEO di Stripe, ricevere una mezza allusione non ufficiale da Google che internet sbeffeggia spietatamente, e assorbire ogni verifica forense condotta dalla community. I media cinesi lo chiamano 牛来. Nessuno ne ha rivendicato la paternità. Tutto ciò che segue è attribuito, datato e non confermato ove specificato.

Aggiornamento (26 ago, sera): mistero svelato — Zhipu ha confermato a Bloomberg che Ox Alpha è GLM-5.3-Flash, con il rilascio ufficiale e i pesi aperti in arrivo stasera. Zixuan Li di Zhipu: "Ox Alpha era una versione preliminare di GLM-5.3-Flash. Il rilascio ufficiale offre prestazioni superiori e una stabilità nettamente migliore." Gli analisti della community lo avevano previsto giorni fa; il copione di Pony Alpha si è ripetuto alla lettera. Dettagli nella sezione La rivelazione in basso.

Risposta diretta

Ox Alpha è GLM-5.3-Flash — confermato ufficialmente da Zhipu a Bloomberg il 26 ago, con il rilascio ufficiale e i pesi aperti in arrivo stasera tramite Z.ai. Il periodo di lancio stealth (su OpenRouter/OpenCode dal 20-21 ago, 1M di contesto, testo+immagini+video, settimana gratuita) è stato un primo stress test pubblico: "intelligenza di frontiera a costi flash", misurato dalla community all'80% contro il 65% di Fable 5 su un campione di 10 task di DeepSWE, e secondo SemiAnalysis, la sua capacità di 100T token/giorno gira su chip cinesi. Zhipu afferma che la versione ufficiale è più performante e più stabile della build preliminare.

La cronologia della settimana, verificata

QuandoCosa è successo · fonte
20-21 agoOx Alpha compare su OpenRouter + OpenCode Zen — 1M di contesto, multimodale, gratuito per ~1 settimana, capacità della piattaforma di "100T token/giorno" (capacità, non parametri). OpenRouter: "solo routing; terza parte anonima." (36氪/APPSO)
21-22 agoLa Silicon Valley si fionda sui test: l'autore di DeepSWE misura il 63% sulla sua suite agentica; il campione di 10 task di Ben Davis: Ox 80% / Fable 5 65% / GPT-5.6 Sol 52%; il CEO di Stripe Patrick Collison commenta "相当惊艳"; i CEO di OpenRouter/T3 Chat/Box amplificano la portata. (36氪)
22-23 agoLe analisi forensi convergono su GLM: i conteggi del tokenizer rispetto a GLM-5.3 differiscono di 75 token esatti su 25 prompt (l'equivalente di un system prompt nascosto); il consumo di token video corrisponde esattamente a GLM-5V-Turbo; gli errori del serving layer coincidono con il dialetto di Z.ai. (TechTimes 08-23; 36氪)
23-24 agoLa non-rivendicazione di Google: i ricercatori di DeepMind alludono a "Gemini" e invitano a "fidarsi del processo" — ampiamente derisi (谷歌抢着认领被全网笑惨, 36氪). Il thread con il verdetto su HN: "Ox-Alpha Is GLM" (26 pt, ancora solo attribuzione della community).
24 ago36氪 riporta che alla finestra di gratuità rimangono "meno di quattro giorni"; il soprannome cinese 牛来 diventa di massa. Ancora zero rivendicazioni ufficiali.

La rivelazione (26 ago): confermato da Bloomberg, pesi stasera

  • Zhipu ha confermato a Bloomberg (mercoledì 26 ago): "il modello Ox Alpha è una nuova iterazione della sua serie GLM" — nello specifico GLM-5.3-Flash — e ha dichiarato che rilascerà i pesi stasera, in risposta alle richieste di Bloomberg News.
  • Zixuan Li di Zhipu (X, @zixuanli_): "Ox Alpha era una versione preliminare di GLM-5.3-Flash. Il rilascio ufficiale offre prestazioni superiori e una stabilità nettamente migliore. Un enorme ringraziamento a @opencode e @OpenRouter per averlo reso disponibile alla community."
  • Il dettaglio sorprendente (SemiAnalysis): i 100T token/giorno dichiarati per la fase stealth venivano erogati su chip cinesi — la settimana gratuita è stata, tra le altre cose, uno stress test per acceleratori domestici su scala d'avanguardia.
  • Prime reazioni: Andrew Curran — "la frontiera di Pareto è stata ridefinita" (annuncio + benchmark già pubblicati); sintesi della community: "GLM-5.3 Flash supera GLM-5.2 in tutto"; lo slogan che circola: "intelligenza di frontiera a costi flash."
  • Il copione si ripete. Il caso di Pony Alpha a febbraio (anonimo → rivendicato da Zhipu come GLM-5 al giorno ~6) aveva previsto esattamente questo: rilascio stealth → traffico gratuito → benchmark → rivelazione. Le analisi forensi sul tokenizer che lo avevano identificato come GLM giorni prima della conferma avevano ragione.
  • Pesi rilasciati (verifica del 27 ago): zai-org/GLM-5.3-Flash (+ BF16) è disponibile su Hugging Face. Dati ufficiali della scheda: 320B totali / 18B attivi, il primo modello nativamente multimodale della serie GLM-5, che supera GLM-5.2 in tutti i benchmark a un decimo del prezzo (≈ $0.14/$0.44 per 1M rispetto a $1.40/$4.40 di 5.2), avvicinandosi a Claude Opus 4.8 nei test di programmazione e suite agentiche — con quantizzazioni llama.cpp / Ollama / LM Studio per l'esecuzione locale. Accoglienza su HN: 809 punti per il modello, 407 per la rivelazione.

Le analisi forensi prima della rivelazione — e quanto ci avevano visto giusto

  • Impronta del tokenizer. Su 25 prompt di controllo, il conteggio dei token di Ox Alpha si colloca esattamente a 75 token sopra quello di GLM-5.3 — la firma di un system prompt nascosto costante sullo stesso tokenizer (riepilogo tecnico di 36氪).
  • Firma dei token video. Quattro test video controllati hanno replicato riga per riga il calcolo dei token per framerate/durata/risoluzione di GLM-5V-Turbo; i modelli di altri fornitori divergevano.
  • Supera il GLM-5.3 pubblico per capacità multimodali. La versione 5.3 rilasciata è solo testuale tramite API — quindi, se è di Zhipu, si tratta di una variante multimodale inedita (nel gergo della community: un cavallo di battaglia di classe GLM-5.5). Il confronto diretto di APPSO ha riscontrato una catena di ragionamento "molto vicina a GLM-5.3" — e Ox ha risolto un test di teoria dei numeri che GLM-5.3-max non era riuscito a completare.
  • I precedenti. Quattro rilasci anonimi su quattro passati su OpenRouter provenivano da laboratori cinesi: Pony Alpha → GLM-5 (rivendicato da Zhipu al giorno 6), Hunter/Healer Alpha → Xiaomi MiMo-V2, Elephant Alpha → Ant Ling-2.6-flash, Owl Alpha → Meituan LongCat-2.0.
  • I limiti (prima della rivelazione). Al 25 ago nulla di tutto ciò era ufficiale — Google alludeva senza rivendicare, Zhipu taceva. Il 26 ago è arrivata la conferma che ha convalidato ogni pista forense sopra citata.

Note pratiche per sviluppatori API

  • Da stealth a ufficiale, stasera. La finestra gratuita (~27-28 ago) si converte ora nel rilascio ufficiale di GLM-5.3-Flash con pesi aperti tramite Z.ai — la finestra di benchmark a costo zero si chiude esattamente con l'arrivo del prodotto reale.
  • Consideratelo come uno stress test stealth. Nessun SLA, nessun preavviso di deprecazione, nessuna attribuzione — adatto per valutazioni e curiosità, ma sconsigliato per il traffico di produzione o dati sensibili.
  • Pesi + API in arrivo stasera tramite Z.ai — tenete d'occhio zai-org su Hugging Face e docs.z.ai; la nostra copertura di GLM-5.3 segue l'intera famiglia, e il resoconto di domani riporterà le specifiche di rilascio verificate.

Fonti primarie

Domande frequenti (2026)

Cos'è Ox Alpha?

Un modello anonimo in modalità stealth su OpenRouter/OpenCode dal 20-21 ago: 1M di contesto, testo+immagini+video, gratuito per ~1 settimana. Nessun laboratorio ne ha rivendicato la paternità. Soprannome sui media cinesi: 牛来.

Quanto è valido?

Campione ridotto ma sorprendente: 80% contro il 65% di Fable 5 su un test di 10 task di DeepSWE; 63% sulla suite dell'autore di DeepSWE. Il CEO di Stripe: "相当惊艳" (secondo 36氪).

Chi lo ha sviluppato?

Confermato il 26 ago: Zhipu — Ox Alpha era una versione preliminare di GLM-5.3-Flash (Bloomberg; Zixuan Li di Zhipu su X). L'offset di +75 del tokenizer e la firma video lo avevano svelato con giorni di anticipo.

Google ne ha rivendicato la paternità?

I ricercatori di DeepMind hanno lanciato forti allusioni ("Gemini", "fidatevi del processo") e sono stati derisi per questo — nessuna conferma da parte di nessuno.

È ancora gratuito?

La finestra gratuita della fase stealth confluisce nel rilascio ufficiale di stasera di GLM-5.3-Flash con pesi aperti tramite Z.ai — l'anteprima gratuita termina con l'arrivo del prodotto reale.

Link ai pesi di GLM-5.3?

Risolto e verificato: i pesi di GLM-5.3-Flash sono disponibili su zai-org (verifica del 27 ago) — 320B/18B attivi, primo modello nativamente multimodale della serie GLM-5, ~1/10 del prezzo di GLM-5.2. La finestra di circa il 28 ago è stata anticipata per Flash.

Guide correlate