ChinaModelAPI

News / Model Watch · Westliche Frontier

Westliche Modelle Gemini 3.7 Flash Google Frontier-Baseline
2026-08-19 · Model Watch

Gemini 3.7 Flash: Googles Workhorse-Modell für Coding und Agenten

Google hat am 13. August 2026 Gemini 3.7 Flash angekündigt und als sein „bislang intelligentestes Workhorse-Modell“ für Coding, Software-Engineering und Agenten-Workflows bezeichnet. Wir beobachten Gemini als westliche Frontier-Baseline im Vergleich zu unseren chinesischen Open-Source-Modellen (dieselbe Rolle wie GPT-5.6 Sol, Claude Opus 5 und Grok 4.6) – hier ist also ein fundierter, quellengestützter Überblick darüber, was Google tatsächlich veröffentlicht hat und was das für einen China-Modell-Stack bedeutet.

Direkte Antwort

Gemini 3.7 Flash erschien am 13. August 2026 – drei Wochen nach Gemini 3.6 Flash. Laut Googles Ankündigung und der offiziellen Gemini API-Dokumentation ist gemini-3.7-flash ein stabiles Modell mit einem Input-Limit von 1.048.576 Tokens (~1M Kontext) und einem Output-Limit von 65.536 Tokens, Thinking-Stufen low/medium/high sowie Agenten-Funktionen wie Function Calling, Code Execution, Search Grounding und Computer Use (Vorschau). Der Einführungspreis beträgt bis zum 31. Dezember 2026 $0.75 / $3.75 pro 1M Tokens (die Hälfte des Einführungspreises von 3.6 Flash). Hinweis: Gemini ist ein westliches Closed-Source-Modell, das nicht über ChinaModelAPI geroutet wird – wir führen es ausschließlich als Vergleichs-Baseline auf.

Was Googles Ankündigung und Dokumentation besagen (verifiziert)

Wir nutzen die offizielle Ankündigung und die API-Dokumentation als verbindliche Quelle. Stand 2026-08-19:

SpezifikationGemini 3.7 Flash (laut Google)
Modell-IDgemini-3.7-flash · in der Gemini API-Dokumentation als stabil gelistet
Angekündigt13. August 2026 (Google Blog, Tulsee Doshi, Senior Director, Product Management)
Input-Token-Limit1.048.576 (~1M Kontext)
Output-Token-Limit65,536
Inputs → OutputText, Bild, Video, Audio, PDF → Text
Thinkinglow / medium / high („minimal“ gibt einen Fehler zurück)
Agenten-FunktionenFunction Calling, Code Execution, Search- & Maps-Grounding, Dateisuche, URL-Kontext, strukturierte Ausgaben, Caching, Batch API, Flex/Priority; Computer Use in der Vorschau. Audio-/Bildgenerierung und Live API werden nicht unterstützt.
VerfügbarkeitGemini API (AI Studio, Android Studio), Google Antigravity, Gemini Enterprise Agent Platform (Model Garden) & Enterprise-App; Spark für AI Pro/Ultra-Abonnenten (160+ Länder; nicht im EWR, in Nigeria, der Schweiz und im Vereinigten Königreich)
SicherheitAktualisierte Schutzmaßnahmen gegen CBRN- und Cyber-Offensive-Missbrauch

Benchmarks im Vergleich zu Gemini 3.6 Flash

Googles Ankündigung berichtet über durchgängige Zuwächse gegenüber 3.6 Flash bei Benchmarks für Coding, Agenten und Dokumenten-Reasoning:

Benchmark3.7 Flash3.6 Flash
FrontierCode 1.1 Main43.6%34.4%
DeepSWE v1.165.3%49.0%
WebDev Arena (Arena.ai) Elo15881538
GDP.pdf34.0%22.0%
AutomationBench (Zapier)30.4%17.0%

Vom Anbieter angegebene Zahlen aus Googles Ankündigung – von uns nicht unabhängig verifiziert. Google nennt außerdem besseres Debugging, höhere First-Pass-Genauigkeit beim Code, verbesserte mehrstufige Planung und Tool Calls sowie eine stärkere Design-Treue bei der UI-Generierung.

Preise und ein Drei-Wochen-Release-Zyklus

Gemini 3.6 Flash erschien am 21. Juli 2026; 3.7 Flash folgte bereits am 13. August – ein Tempo, das englischsprachige Medien besonders hervorhoben (Ars Technica: „nur drei Wochen nach dem vorherigen Release“). Google führt diese Geschwindigkeit auf Entwickler-Feedback und algorithmische Innovationen zurück, die auch in künftigen Modellen wiederverwendet werden sollen. Zu den Preisen:

  • Bis 31. Dez. 2026: $0.75 pro 1M Input-Tokens · $3.75 pro 1M Output-Tokens – die Hälfte der Token-Kosten des Einführungspreises von 3.6 Flash.
  • Ab 1. Jan. 2027: Standardpreise von $1.50 Input / $7.50 Output pro 1M Tokens.
  • Einordnung: VentureBeat fasste den Start so zusammen, dass Google „mit einem 50-prozentigen Einführungsrabatt auf Coding und Agenten abzielt.“

Bedeutung für Entwickler mit China-Modellen

Gemini 3.7 Flash ist kein Modell, das ChinaModelAPI anbindet – es ist ein westliches Closed-Source-Modell. Wir führen es als Qualitäts- und Kostenobergrenzen-Referenz, genau wie GPT-5.6 Sol, Claude Opus 5 und Grok 4.6 in unseren Model-Watch-Übersichten. Der bemerkenswerte Wandel: Sein ~1M-Kontext und die aggressive Einführungspreisgestaltung schließen zwei Lücken, bei denen chinesische Flaggschiffe zuvor klar im Vorteil waren.

ModellHerkunft / ZugangOptimale Rolle im Stack
Gemini 3.7 FlashGoogle · geschlossene APIWestliche Workhorse-Baseline (Coding / Agenten)
DeepSeek-V4-Pro-0813DeepSeek · Open WeightsFrontier-Agenten/Reasoning, selbst hostbar, günstig
Qwen3.8-MaxAlibaba · Open WeightsCoding & komplexe Langzeit-Aufgaben
GLM-5.3 / Kimi K3Zhipu / Moonshot · offen1M-Kontext für Long-Horizon-Workflows & Agenten

Vollständiger Live-Vergleich: Vergleich chinesischer KI-Modelle.

Primärquellen

FAQ

Kann ich Gemini 3.7 Flash über ChinaModelAPI aufrufen?

Nein. Gemini ist ein westliches Closed-Source-Modell. ChinaModelAPI bindet chinesische Frontier-Modelle an (DeepSeek, Qwen, GLM, Kimi, Seedance, HappyHorse). Wir führen Gemini 3.7 Flash hier nur als westliche Baseline zum Vergleich auf.

1M-Kontext – Gleichstand mit chinesischen Flaggschiffen?

Auf dem Papier ja: 1.048.576 Input-Tokens entsprechen der 1M-Klasse, mit der DeepSeek-V4-Pro, Qwen3.8, GLM-5.2/5.3 und Kimi K3 werben. Chinesische Open-Weight-Modelle bleiben selbst hostbar und sind pro Token in der Regel günstiger.

Ist der Preis von $0.75/$3.75 dauerhaft gültig?

Nein – es handelt sich um Einführungspreise bis zum 31. Dezember 2026. Ab dem 1. Januar 2027 beträgt der Standardpreis laut Googles Ankündigung $1.50 Input / $7.50 Output pro 1M Tokens.

Sind die Benchmark-Zahlen unabhängig verifiziert?

Nein. Die Werte von 43.6% FrontierCode / 65.3% DeepSWE / 1588 WebDev Arena Elo sind Herstellerangaben von Google im Vergleich von 3.7 Flash zu 3.6 Flash. Sie sollten als Richtwerte betrachtet werden, bis unabhängige Drittevaluierungen vorliegen.

Verwandte Leitfäden