Notizie / Osservatorio settimanale dei modelli
Settimanale
Osservatorio modelli
Snapshot automatico
Aggiornato al 2026-08-30
Pagina dinamica — aggiornata settimanalmente. Snapshot attuale dei dati: settimana del 2026-08-20.
China Model Watch — Stato settimanale dei modelli AI cinesi
Snapshot del registro dalla tabella dei modelli di punta di ChinaModelAPI (al 2026-08-20). Questo post rappresenta la cadenza settimanale automatizzata per la freschezza SEO/GEO — non inventa nuove versioni dei modelli.
Risposta diretta
Stack cinese attuale monitorato per sviluppatori API: Qwen3.8-Max-Preview · DeepSeek-V4-Pro · DeepSeek-V4-Flash · GLM-5.2 · Kimi K3…. I benchmark occidentali di riferimento rimangono GPT-5.6 Sol e Claude Opus 5. Per la generazione video in produzione, il modello predefinito resta Seedance 2.0, mentre la versione 2.5 è prevista nella finestra di agosto, salvo conferma della GA.
Modelli cinesi (monitorati)
| Modello | Produttore | Note |
|---|---|---|
| Qwen3.8-Max-Preview | Alibaba | 1M |
| DeepSeek-V4-Pro-0813 | DeepSeek | Versione ufficiale (GA) 2026-08-13; agenti potenziati; model ID deepseek-v4-pro invariato; lieve adeguamento del prezzo delle API. Harness v0.1 (dsh) rilasciato open source la sera del 2026-08-13: agent harness in dev-preview MIT, architettura everything-is-a-plugin su Cordis; modalità minimal = framework di benchmark ufficiale. Harness multimodale (al 08-20): rc.7 (17-08) allegati immagine persistenti MCP/ACP; rc.8 (19-08) richieste immagini native configurabili per gli adapter DeepSeek + input immagini per /goal //plan; npm latest=rc.7, rc.8 su next; V4-Pro/V4-Flash restano solo testo (changelog ufficiale delle API invariato dal 13-08). |
| DeepSeek-V4-Flash | DeepSeek | 1M |
| GLM-5.2 (prod) / GLM-5.3 (rilasciato il 14-08) | Zhipu/Z.ai | Aggiornamento GLM-5.3 (al 19-08): prezzi API pubblicati su docs.z.ai in USD internazionali — $1.40 input / $0.26 cached / $4.40 output per 1M, identici a 5.2; OpenRouter ha inserito lo stesso prezzo il 18-08. Prima valutazione indipendente: Artificial Analysis II v4.1.1 = 60, posizione 8/182 (max-effort 59.5 vs Kimi K3 59.7 / GPT-5.6 Sol 60.9 / Opus 5 61.5), segnalato come 'molto prolisso' (170M vs 72M token mediani nel run dell'indice). Pesi NON ancora presenti su HF zai-org (verificato il 19-08), previsti verso il 28-08 dopo il safety hardening. Numeri del fornitore: Terminal-Bench 3.0 4.6→28.3, DeepSWE 46.2→66.9, CyberGym 84.5%, 2.436 vulnerabilità reali (1.097 critiche/alte secondo il grafico). Breaking change API: rimosso thinking.type 'disabled'. Stampa in lingua inglese: VentureBeat (affermazione sulla vulnerabilità di Cursor, non confermata), The Decoder, Interconnects (~750B parametri, ~$1B di ARR stimati), Reuters (trusted access), thread da 1.167 punti su HN. In produzione rimane glm-5.2 fino alla GA di 5.3 e a una piena stabilità tramite relay. |
| Kimi K3 | Moonshot | 1M |
| Seedance 2.0 (prod) / 2.5 (finestra di agosto) | ByteDance | 2.5: ~30s nativi; accesso anticipato 年框; GA posticipata da inizio/metà luglio ad agosto |
| HappyHorse | Alibaba | video |
Benchmark occidentali
| Modello | Produttore | Note |
|---|---|---|
| GPT-5.6 Sol | OpenAI | Livello flagship Sol; Terra/Luna più economici |
| Claude Opus 5 | Anthropic | Linea Opus; Sonnet 5 fascia media |
| Grok 4.6 | xAI | Indicato nella documentazione ufficiale di xAI come modello di punta consigliato; contesto da 500k; $2/$6 per 1M (<200k prompt); knowledge cutoff 2026-02-01. Solo baseline occidentale — non instradato da ChinaModelAPI. |
| Gemini 3.7 Flash | Annunciato il 13-08-2026 (3 settimane dopo 3.6 Flash); 'cavallo di battaglia più intelligente' per coding e agenti; gemini-3.7-flash stabile nella documentazione delle API Gemini; 1.048.576 input / 65.536 output; thinking low/med/high; benchmark del fornitore DeepSWE 65.3% / FrontierCode 43.6%; offerta di lancio $0.75/$3.75 per 1M fino al 31-12-2026, poi $1.50/$7.50. Solo baseline occidentale — non instradato da ChinaModelAPI. |
Come funziona questa automazione
- Settimanale (lun) — pubblicazione automatica di questo snapshot da
data/model-watch/current-flagships.json. - Report approfonditi — redatti quando cambiano i modelli di punta o quando una sessione di ricerca compila
draft-*.md. - Policy sulle fonti — priorità alla documentazione ufficiale; X usato solo per il discovery. Questo post automatico non effettua scraping dei feed social.