Notizie / Model Watch · LLM
Qwen3.8-Max: il modello di punta da ~2.4T di Alibaba — Non un nuovo generatore video
All'inizio di agosto 2026, il team Qwen di Alibaba ha messo sotto i riflettori Qwen3.8-Max come il modello più avanzato della famiglia Qwen fino a oggi (i materiali pubblici parlano di circa 2,4 mila miliardi di parametri). Questa sintesi è pensata per gli sviluppatori di API — e per smentire una voce diffusa che crea confusione con Qwen2.5-VL / Qwen2-VL.
Aggiornamento (21 ago 2026): i pesi aperti annunciati come "in arrivo" sono stati rilasciati — Qwen3.8-2.4T-A95B (+FP8) e la versione Apache-2.0 da 27B sono disponibili su Hugging Face. I nomi dei repository, le clausole della licenza e una guida per l'esecuzione in locale si trovano nel resoconto di approfondimento.
Sì — vale un post di Model Watch come aggiornamento sui modelli di punta LLM / agent. No — non pubblicare “Alibaba ha appena rilasciato Qwen2-VL-72B / Qwen2.5-VL come modello video di classe Seedance.” Qwen2.5-VL è una linea di comprensione visivo-linguistica (visione di immagini, comprensione di video lunghi, controllo di interfacce utente) proveniente da un ciclo di rilascio precedente — uno scopo ben diverso rispetto alla generazione video di Seedance 2.5 o MiniMax H3.
Cos'è Qwen3.8-Max (dai materiali di lancio pubblici)
- Modello linguistico di punta nell'era Qwen 3.x — posizionamento: coding, lavoro nel mondo reale, ricerca, task a lungo termine.
- Dimensioni: materiali e articoli di settore indicano un ordine di grandezza di ~2.4T parametri (durante l'integrazione, fare riferimento alla documentazione ufficiale per il conteggio esatto dei parametri MoE/attivi).
- Pesi aperti: al momento della pubblicazione (8 ago) si trattava di una promessa; sono arrivati nella settimana tra il 12 e il 17 ago — 2.4T-A95B (+FP8) e una versione Apache-2.0 da 27B su Hugging Face, con i dettagli sulla licenza nell'approfondimento.
- Disponibilità del prodotto: percorsi di erogazione tramite Qwen Chat / Alibaba Cloud; gli SKU enterprise/API seguono la nomenclatura della console (gli ID potrebbero differire dai nomi commerciali).
Tabella di chiarezza sui nomi (voci vs fatti)
| Nome citato | Cos'è in realtà | Generazione video? |
|---|---|---|
| Qwen3.8-Max | Flagship LLM di ago 2026 (narrazione di ~2.4T) | No (focalizzato su testo/agenti) |
| Qwen2.5-VL | Famiglia di comprensione visivo-linguistica (linea dal 2025 in poi) | Comprende i video; non sostituisce i generatori come Seedance/H3 |
| Qwen2-VL-72B | Dimensione VL precedente della serie Qwen2-VL | Stessa cosa — VL, non un modello T2V di punta |
| Qwen3-VL (encoder in altri stack) | Utilizzato come encoder all'interno di alcuni sistemi video (es. stack aperti di H3) | Ruolo come componente ≠ “Alibaba ha rilasciato oggi un modello video” |
| Qwen-Image-3.0 | Linea separata per la generazione di immagini | Immagini, non generazione video |
Perché la voce si diffonde su X
- I modelli VL “gestiscono i video” nelle demo (comprensione di video lunghi) → le persone sentono “modello video”.
- I generatori video caricano gli encoder Qwen-VL → nelle conversazioni informali si dice “Qwen ha appena rilasciato un modello video”.
- Agosto 2026 è ricco di novità (Seedance 2.5, MiniMax H3, Qwen3.8-Max) → i nomi dei brand si confondono.
Regola di ChinaModelAPI: i modelli di generazione video (Seedance, H3, HappyHorse…) rimangono nel cluster video; la comprensione VL e i modelli LLM di punta hanno post dedicati con ruoli espliciti.
Checklist per sviluppatori
- Se hai bisogno di coding / agent / chat con contesto lungo → valuta Qwen3.8-Max (e i modelli densi 3.x più piccoli per l'esecuzione in locale).
- Se hai bisogno di comprensione di documenti / screenshot / video → usa uno SKU Qwen-VL attuale, non Max considerandolo come T2V.
- Se hai bisogno di generazione text-to-video → Seedance / H3 / simili; consulta i resoconti sui video collegati sotto.
- Attendi gli ID dei modelli ufficiali su Alibaba Cloud / relay compatibili con OpenAI prima di inserire nel codice i nomi commerciali.
- Le note sull'accesso a Qwen di ChinaModelAPI rimangono nella guida alle API di Qwen; Max apparirà quando il routing avrà superato i controlli di integrità.
FAQ
Max è un modello video?
No. Modello linguistico/operativo di punta. Le funzionalità multimodali potrebbero comparire tramite lo stack di erogazione — comunque non un T2V di classe Seedance.
Dovremmo aggiornare la guida di Qwen?
Quando sarà disponibile un ID di produzione stabile sul nostro relay, sì. Fino ad allora questo articolo di notizie + lista d'attesa è sufficiente.