News / Model Watch · Westliche Frontier
Gemini 3.7 Flash: Googles Workhorse-Modell für Coding und Agenten
Google hat am 13. August 2026 Gemini 3.7 Flash angekündigt und als sein „bislang intelligentestes Workhorse-Modell“ für Coding, Software-Engineering und Agenten-Workflows bezeichnet. Wir beobachten Gemini als westliche Frontier-Baseline im Vergleich zu unseren chinesischen Open-Source-Modellen (dieselbe Rolle wie GPT-5.6 Sol, Claude Opus 5 und Grok 4.6) – hier ist also ein fundierter, quellengestützter Überblick darüber, was Google tatsächlich veröffentlicht hat und was das für einen China-Modell-Stack bedeutet.
Gemini 3.7 Flash erschien am 13. August 2026 – drei Wochen nach Gemini 3.6 Flash.
Laut Googles Ankündigung und der offiziellen Gemini API-Dokumentation ist gemini-3.7-flash ein stabiles Modell mit einem
Input-Limit von 1.048.576 Tokens (~1M Kontext) und einem Output-Limit von 65.536 Tokens,
Thinking-Stufen low/medium/high sowie Agenten-Funktionen wie Function Calling, Code Execution, Search Grounding und Computer Use (Vorschau).
Der Einführungspreis beträgt bis zum 31. Dezember 2026 $0.75 / $3.75 pro 1M Tokens (die Hälfte des Einführungspreises von 3.6 Flash).
Hinweis: Gemini ist ein westliches Closed-Source-Modell, das nicht über ChinaModelAPI geroutet wird – wir führen es ausschließlich als Vergleichs-Baseline auf.
Was Googles Ankündigung und Dokumentation besagen (verifiziert)
Wir nutzen die offizielle Ankündigung und die API-Dokumentation als verbindliche Quelle. Stand 2026-08-19:
| Spezifikation | Gemini 3.7 Flash (laut Google) |
|---|---|
| Modell-ID | gemini-3.7-flash · in der Gemini API-Dokumentation als stabil gelistet |
| Angekündigt | 13. August 2026 (Google Blog, Tulsee Doshi, Senior Director, Product Management) |
| Input-Token-Limit | 1.048.576 (~1M Kontext) |
| Output-Token-Limit | 65,536 |
| Inputs → Output | Text, Bild, Video, Audio, PDF → Text |
| Thinking | low / medium / high („minimal“ gibt einen Fehler zurück) |
| Agenten-Funktionen | Function Calling, Code Execution, Search- & Maps-Grounding, Dateisuche, URL-Kontext, strukturierte Ausgaben, Caching, Batch API, Flex/Priority; Computer Use in der Vorschau. Audio-/Bildgenerierung und Live API werden nicht unterstützt. |
| Verfügbarkeit | Gemini API (AI Studio, Android Studio), Google Antigravity, Gemini Enterprise Agent Platform (Model Garden) & Enterprise-App; Spark für AI Pro/Ultra-Abonnenten (160+ Länder; nicht im EWR, in Nigeria, der Schweiz und im Vereinigten Königreich) |
| Sicherheit | Aktualisierte Schutzmaßnahmen gegen CBRN- und Cyber-Offensive-Missbrauch |
Benchmarks im Vergleich zu Gemini 3.6 Flash
Googles Ankündigung berichtet über durchgängige Zuwächse gegenüber 3.6 Flash bei Benchmarks für Coding, Agenten und Dokumenten-Reasoning:
| Benchmark | 3.7 Flash | 3.6 Flash |
|---|---|---|
| FrontierCode 1.1 Main | 43.6% | 34.4% |
| DeepSWE v1.1 | 65.3% | 49.0% |
| WebDev Arena (Arena.ai) Elo | 1588 | 1538 |
| GDP.pdf | 34.0% | 22.0% |
| AutomationBench (Zapier) | 30.4% | 17.0% |
Vom Anbieter angegebene Zahlen aus Googles Ankündigung – von uns nicht unabhängig verifiziert. Google nennt außerdem besseres Debugging, höhere First-Pass-Genauigkeit beim Code, verbesserte mehrstufige Planung und Tool Calls sowie eine stärkere Design-Treue bei der UI-Generierung.
Preise und ein Drei-Wochen-Release-Zyklus
Gemini 3.6 Flash erschien am 21. Juli 2026; 3.7 Flash folgte bereits am 13. August – ein Tempo, das englischsprachige Medien besonders hervorhoben (Ars Technica: „nur drei Wochen nach dem vorherigen Release“). Google führt diese Geschwindigkeit auf Entwickler-Feedback und algorithmische Innovationen zurück, die auch in künftigen Modellen wiederverwendet werden sollen. Zu den Preisen:
- Bis 31. Dez. 2026: $0.75 pro 1M Input-Tokens · $3.75 pro 1M Output-Tokens – die Hälfte der Token-Kosten des Einführungspreises von 3.6 Flash.
- Ab 1. Jan. 2027: Standardpreise von $1.50 Input / $7.50 Output pro 1M Tokens.
- Einordnung: VentureBeat fasste den Start so zusammen, dass Google „mit einem 50-prozentigen Einführungsrabatt auf Coding und Agenten abzielt.“
Bedeutung für Entwickler mit China-Modellen
Gemini 3.7 Flash ist kein Modell, das ChinaModelAPI anbindet – es ist ein westliches Closed-Source-Modell. Wir führen es als Qualitäts- und Kostenobergrenzen-Referenz, genau wie GPT-5.6 Sol, Claude Opus 5 und Grok 4.6 in unseren Model-Watch-Übersichten. Der bemerkenswerte Wandel: Sein ~1M-Kontext und die aggressive Einführungspreisgestaltung schließen zwei Lücken, bei denen chinesische Flaggschiffe zuvor klar im Vorteil waren.
| Modell | Herkunft / Zugang | Optimale Rolle im Stack |
|---|---|---|
| Gemini 3.7 Flash | Google · geschlossene API | Westliche Workhorse-Baseline (Coding / Agenten) |
| DeepSeek-V4-Pro-0813 | DeepSeek · Open Weights | Frontier-Agenten/Reasoning, selbst hostbar, günstig |
| Qwen3.8-Max | Alibaba · Open Weights | Coding & komplexe Langzeit-Aufgaben |
| GLM-5.3 / Kimi K3 | Zhipu / Moonshot · offen | 1M-Kontext für Long-Horizon-Workflows & Agenten |
Vollständiger Live-Vergleich: Vergleich chinesischer KI-Modelle.
Primärquellen
- Google Blog — Gemini 3.7 Flash: our most intelligent workhorse model (offizielle Ankündigung, 13. Aug. 2026)
- Gemini API-Dokumentation – Modellseite zu gemini-3.7-flash (1.048.576 Input / 65.536 Output, Thinking-Stufen, Feature-Unterstützung)
- Gemini API-Dokumentation – Modellkatalog (gemini-3.7-flash als stabil gelistet)
- 9to5Google – Launch von Gemini 3.7 Flash (13. Aug. 2026)
- VentureBeat – Googles Gemini 3.7 Flash zielt mit 50 % Einführungsrabatt auf Coding und Agenten ab
- Ars Technica – Google kündigt Gemini 3.7 Flash nur drei Wochen nach der vorherigen Version an
FAQ
Kann ich Gemini 3.7 Flash über ChinaModelAPI aufrufen?
Nein. Gemini ist ein westliches Closed-Source-Modell. ChinaModelAPI bindet chinesische Frontier-Modelle an (DeepSeek, Qwen, GLM, Kimi, Seedance, HappyHorse). Wir führen Gemini 3.7 Flash hier nur als westliche Baseline zum Vergleich auf.
1M-Kontext – Gleichstand mit chinesischen Flaggschiffen?
Auf dem Papier ja: 1.048.576 Input-Tokens entsprechen der 1M-Klasse, mit der DeepSeek-V4-Pro, Qwen3.8, GLM-5.2/5.3 und Kimi K3 werben. Chinesische Open-Weight-Modelle bleiben selbst hostbar und sind pro Token in der Regel günstiger.
Ist der Preis von $0.75/$3.75 dauerhaft gültig?
Nein – es handelt sich um Einführungspreise bis zum 31. Dezember 2026. Ab dem 1. Januar 2027 beträgt der Standardpreis laut Googles Ankündigung $1.50 Input / $7.50 Output pro 1M Tokens.
Sind die Benchmark-Zahlen unabhängig verifiziert?
Nein. Die Werte von 43.6% FrontierCode / 65.3% DeepSWE / 1588 WebDev Arena Elo sind Herstellerangaben von Google im Vergleich von 3.7 Flash zu 3.6 Flash. Sie sollten als Richtwerte betrachtet werden, bis unabhängige Drittevaluierungen vorliegen.