Notizie / Model Watch · Frontiera occidentale
Gemini 3.7 Flash: il modello workhorse di Google per coding e agenti
Google ha annunciato Gemini 3.7 Flash il 13 agosto 2026, definendolo il suo "modello workhorse più intelligente di sempre" per coding, ingegria del software e flussi di lavoro agentici. Monitoriamo Gemini come baseline di frontiera occidentale rispetto ai nostri modelli aperti cinesi (lo stesso ruolo svolto da GPT-5.6 Sol, Claude Opus 5 e Grok 4.6) — ecco quindi un'analisi chiara e documentata su ciò che Google ha effettivamente rilasciato e su cosa significhi per uno stack di modelli cinesi.
Gemini 3.7 Flash è stato rilasciato il 13 agosto 2026 — tre settimane dopo Gemini 3.6 Flash.
Secondo l'annuncio di Google e la documentazione ufficiale dell'API Gemini, gemini-3.7-flash è un modello stabile con un
limite di input di 1.048.576 token (~1M di contesto) e un limite di output di 65.536 token,
livelli di ragionamento low/medium/high e funzionalità agentiche tra cui function calling, esecuzione di codice, search grounding e computer use (in anteprima).
Il prezzo promozionale è di $0.75 / $3.75 per 1M di token (la metà del prezzo di lancio di 3.6 Flash) fino al 31 dicembre 2026.
Nota: Gemini è un modello proprietario occidentale, non instradato da ChinaModelAPI — lo trattiamo unicamente come baseline di confronto.
Cosa dicono l'annuncio e la documentazione di Google (verificato)
Utilizziamo l'annuncio ufficiale e la documentazione dell'API come fonte di verità. Al 2026-08-19:
| Specifiche | Gemini 3.7 Flash (secondo Google) |
|---|---|
| ID modello | gemini-3.7-flash · indicato come stabile nella documentazione dell'API Gemini |
| Annunciato | 13 agosto 2026 (Google blog, Tulsee Doshi, Senior Director, Product Management) |
| Limite token di input | 1.048.576 (~1M di contesto) |
| Limite token di output | 65,536 |
| Input → output | Testo, immagini, video, audio, PDF → testo |
| Thinking | low / medium / high (“minimal” restituisce un errore) |
| Funzionalità agentiche | Function calling, esecuzione di codice, grounding con Ricerca & Maps, file search, contesto da URL, output strutturati, caching, Batch API, Flex/Priority; computer use in anteprima. Generazione audio/immagini e Live API non supportate. |
| Disponibilità | Gemini API (AI Studio, Android Studio), Google Antigravity, Gemini Enterprise Agent Platform (Model Garden) & app Enterprise; Spark per gli abbonati AI Pro/Ultra (oltre 160 paesi; esclusi SEE, Nigeria, Svizzera, Regno Unito) |
| Sicurezza | Meccanismi di sicurezza aggiornati contro i rischi CBRN e l'uso improprio per cyber-offensiva |
Benchmark rispetto a Gemini 3.6 Flash
L'annuncio di Google riporta miglioramenti generalizzati rispetto a 3.6 Flash nei benchmark di coding, agenti e ragionamento su documenti:
| Benchmark | 3.7 Flash | 3.6 Flash |
|---|---|---|
| FrontierCode 1.1 Main | 43.6% | 34.4% |
| DeepSWE v1.1 | 65.3% | 49.0% |
| WebDev Arena (Arena.ai) Elo | 1588 | 1538 |
| GDP.pdf | 34.0% | 22.0% |
| AutomationBench (Zapier) | 30.4% | 17.0% |
Dati dichiarati dal fornitore tratti dall'annuncio di Google — non verificati in modo indipendente da noi. Google cita inoltre un debugging superiore, una maggiore accuratezza del codice al primo tentativo, una pianificazione multi-step e chiamate di strumenti migliorate, oltre a una più fedele aderenza al design nella generazione di UI.
Prezzi e un ciclo di rilascio di tre settimane
Gemini 3.6 Flash è uscito il 21 luglio 2026; 3.7 Flash è seguito il 13 agosto — una cadenza che i media in lingua inglese hanno sottolineato con enfasi (Ars Technica: "a sole tre settimane dal rilascio precedente"). Google attribuisce questa rapidità al feedback degli sviluppatori e a innovazioni algoritmiche che prevede di riutilizzare nei modelli futuri. Riguardo ai prezzi:
- Fino al 31 dicembre 2026: $0.75 per 1M di token di input · $3.75 per 1M di token di output — la metà del costo per token rispetto al prezzo di lancio di 3.6 Flash.
- Dal 1° gennaio 2027: prezzo standard di $1.50 in input / $7.50 in output per 1M di token.
- Inquadramento: VentureBeat ha sintetizzato il lancio affermando che Google "punta a coding e agenti con un taglio di prezzo promozionale del 50%."
Cosa comporta per chi sviluppa con modelli cinesi
Gemini 3.7 Flash non è un modello instradato da ChinaModelAPI — è un modello proprietario occidentale. Lo monitoriamo come riferimento per il tetto massimo di qualità e costi, esattamente come GPT-5.6 Sol, Claude Opus 5 e Grok 4.6 nelle nostre tabelle di monitoraggio dei modelli. Il cambiamento degno di nota: il suo contesto da ~1M e il prezzo di lancio aggressivo colmano due divari che i modelli di punta cinesi mantenevano chiaramente.
| Modello | Origine / accesso | Miglior ruolo nel tuo stack |
|---|---|---|
| Gemini 3.7 Flash | Google · API proprietaria | Baseline workhorse occidentale (coding / agenti) |
| DeepSeek-V4-Pro-0813 | DeepSeek · pesi aperti | Agenti/ragionamento di frontiera, self-hostabile, economico |
| Qwen3.8-Max | Alibaba · pesi aperti | Coding & task a lungo orizzonte |
| GLM-5.3 / Kimi K3 | Zhipu / Moonshot · aperti | Contesto da 1M per task a lungo orizzonte & agenti |
Confronto completo in tempo reale: Confronto tra modelli di IA cinesi.
Fonti primarie
- Google Blog — Gemini 3.7 Flash: our most intelligent workhorse model (annuncio ufficiale, 13 ago 2026)
- Documentazione Gemini API — pagina del modello gemini-3.7-flash (1.048.576 input / 65.536 output, livelli di thinking, supporto funzionalità)
- Documentazione Gemini API — catalogo dei modelli (gemini-3.7-flash indicato come stabile)
- 9to5Google — Lancio di Gemini 3.7 Flash (13 ago 2026)
- VentureBeat — Gemini 3.7 Flash di Google punta a coding e agenti con un taglio di prezzo promozionale del 50%
- Ars Technica — Google annuncia Gemini 3.7 Flash a sole tre settimane dalla versione precedente
FAQ
Posso chiamare Gemini 3.7 Flash tramite ChinaModelAPI?
No. Gemini è un modello proprietario occidentale. ChinaModelAPI instrada modelli di frontiera cinesi (DeepSeek, Qwen, GLM, Kimi, Seedance, HappyHorse). Includiamo Gemini 3.7 Flash qui solo come baseline occidentale di confronto.
Contesto da 1M — parità con i modelli di punta cinesi?
Sulla carta, sì: 1.048.576 token di input eguagliano la classe da 1M pubblicizzata da DeepSeek-V4-Pro, Qwen3.8, GLM-5.2/5.3 e Kimi K3. I modelli cinesi a pesi aperti rimangono self-hostabili e in genere più economici per token.
Il prezzo di $0.75/$3.75 è permanente?
No — si tratta di una tariffa promozionale valida fino al 31 dicembre 2026. Dal 1° gennaio 2027, il prezzo standard sarà di $1.50 in input / $7.50 in output per 1M di token, come indicato nell'annuncio di Google.
I dati dei benchmark sono indipendenti?
No. I dati di 43.6% FrontierCode / 65.3% DeepSWE / 1588 WebDev Arena Elo sono dichiarati direttamente da Google nel confronto tra 3.7 Flash e 3.6 Flash. Vanno considerati come indicativi fino alla pubblicazione di benchmark indipendenti di terze parti.