ChinaModelAPI

Actualités / Veille modèles · Frontière occidentale

Veille occidentale Gemini 3.7 Flash Google Référence frontière
2026-08-19 · Veille modèles

Gemini 3.7 Flash : le modèle polyvalent de Google pour le code et les agents

Google a annoncé Gemini 3.7 Flash le 13 août 2026, le présentant comme son « modèle polyvalent le plus intelligent à ce jour » pour le code, l'ingénierie logicielle et les flux de travail d'agents. Nous suivons Gemini comme une référence frontière occidentale face à nos modèles ouverts chinois (le même rôle que jouent GPT-5.6 Sol, Claude Opus 5 et Grok 4.6) — voici donc une analyse claire et sourcée de ce que Google a réellement lancé, et ce que cela implique pour un écosystème de modèles chinois.

Réponse directe

Gemini 3.7 Flash est sorti le 13 août 2026 — trois semaines après Gemini 3.6 Flash. Selon l'annonce de Google et la documentation officielle de l'API Gemini, gemini-3.7-flash est un modèle stable doté d'une limite d'entrée de 1,048,576 tokens (~1M de contexte) et d'une limite de sortie de 65,536 tokens, avec des niveaux de réflexion low/medium/high, et des fonctionnalités pour agents incluant le function calling, l'exécution de code, l'ancrage search & Maps, la recherche de fichiers, le contexte d'URL, les sorties structurées, la mise en cache, l'API Batch, Flex/Priority ; computer use en préversion. Génération audio/image et API Live non prises en charge. Le tarif de lancement est de $0.75 / $3.75 par 1M de tokens (la moitié du prix de lancement du 3.6 Flash) jusqu'au 31 décembre 2026. Remarque : Gemini est un modèle fermé occidental, non routé par ChinaModelAPI — nous le couvrons uniquement comme base de comparaison.

Ce que disent l'annonce et la documentation de Google (vérifié)

Nous utilisons l'annonce officielle et la documentation de l'API comme source de vérité. Au 2026-08-19 :

SpécificationsGemini 3.7 Flash (selon Google)
ID du modèlegemini-3.7-flash · répertorié comme stable dans la documentation de l'API Gemini
Annoncé13 août 2026 (blog Google, Tulsee Doshi, Senior Director, Product Management)
Limite de tokens en entrée1,048,576 (~1M de contexte)
Limite de tokens en sortie65,536
Entrées → sortieTexte, image, vidéo, audio, PDF → texte
Réflexionlow / medium / high (« minimal » renvoie une erreur)
Fonctionnalités pour agentsFunction calling, exécution de code, ancrage Search & Maps, recherche de fichiers, contexte d'URL, sorties structurées, mise en cache, API Batch, Flex/Priority ; computer use en préversion. Génération audio/image et API Live non prises en charge.
DisponibilitéAPI Gemini (AI Studio, Android Studio), Google Antigravity, Gemini Enterprise Agent Platform (Model Garden) & application Enterprise ; Spark pour les abonnés AI Pro/Ultra (160+ pays ; hors EEE, Nigeria, Suisse, Royaume-Uni)
SécuritéGarde-fous mis à jour contre les risques NRBC et l'usage malveillant cyberoffensif

Benchmarks vs Gemini 3.6 Flash

L'annonce de Google fait état de gains généralisés par rapport au 3.6 Flash sur les benchmarks de code, d'agents et de raisonnement sur documents :

Benchmark3.7 Flash3.6 Flash
FrontierCode 1.1 Main43.6%34.4%
DeepSWE v1.165.3%49.0%
WebDev Arena (Arena.ai) Elo15881538
GDP.pdf34.0%22.0%
AutomationBench (Zapier)30.4%17.0%

Chiffres déclarés par le fournisseur d'après l'annonce de Google — non vérifiés de manière indépendante par nos soins. Google mentionne également un meilleur débogage, une plus grande précision du code dès le premier passage, une planification multi-étapes et des appels d'outils améliorés, ainsi qu'un meilleur respect des maquettes lors de la génération d'interfaces utilisateur.

Tarification et rythme de sortie de trois semaines

Gemini 3.6 Flash est sorti le 21 juillet 2026 ; le 3.7 Flash a suivi le 13 août — une cadence largement soulignée par les médias anglophones (Ars Technica : « trois semaines seulement après la version précédente »). Google attribue cette rapidité aux retours des développeurs et à des innovations algorithmiques qu'elle prévoit de réutiliser dans de futurs modèles. Concernant les prix :

  • Jusqu'au 31 déc. 2026 : $0.75 par 1M de tokens en entrée · $3.75 par 1M de tokens en sortie — soit la moitié du coût par token du tarif de lancement du 3.6 Flash.
  • À partir du 1er janv. 2027 : tarif standard de $1.50 en entrée / $7.50 en sortie par 1M de tokens.
  • Perspective : VentureBeat a résumé le lancement en indiquant que Google « cible le code et les agents avec une baisse de prix de lancement de 50 %. »

Ce que cela implique pour un concepteur exploitant des modèles chinois

Gemini 3.7 Flash n'est pas un modèle routé par ChinaModelAPI — il s'agit d'un modèle fermé occidental. Nous le suivons comme une référence de plafond de qualité et de coût, exactement comme GPT-5.6 Sol, Claude Opus 5 et Grok 4.6 dans nos tableaux de veille de modèles. L'évolution notable : son contexte d'environ ~1M et son tarif de lancement agressif comblent deux écarts dont bénéficiaient nettement les modèles phares chinois.

ModèleOrigine / accèsMeilleur rôle dans votre stack
Gemini 3.7 FlashGoogle · API ferméeRéférence polyvalente occidentale (code / agents)
DeepSeek-V4-Pro-0813DeepSeek · poids ouvertsAgents/raisonnement de pointe, auto-hébergeable, économique
Qwen3.8-MaxAlibaba · poids ouvertsCode & tâches à long horizon
GLM-5.3 / Kimi K3Zhipu / Moonshot · ouvertContexte de 1M, tâches à long horizon & agents

Comparatif complet en direct : Comparatif des modèles d'IA chinois.

Sources primaires

FAQ

Puis-je appeler Gemini 3.7 Flash via ChinaModelAPI ?

Non. Gemini est un modèle fermé occidental. ChinaModelAPI route les modèles de pointe chinois (DeepSeek, Qwen, GLM, Kimi, Seedance, HappyHorse). Nous listons Gemini 3.7 Flash ici uniquement comme point de comparaison occidental.

Contexte de 1M — parité avec les modèles phares chinois ?

Sur le papier, oui : 1,048,576 tokens en entrée correspond à la catégorie 1M annoncée par DeepSeek-V4-Pro, Qwen3.8, GLM-5.2/5.3 et Kimi K3. Les modèles chinois open-weight restent auto-hébergeables et généralement moins chers par token.

Le tarif de $0.75/$3.75 est-il permanent ?

Non — il s'agit d'un tarif de lancement valable jusqu'au 31 décembre 2026. À partir du 1er janvier 2027, la tarification standard sera de $1.50 en entrée / $7.50 en sortie par 1M de tokens, selon l'annonce de Google.

Les chiffres des benchmarks sont-ils indépendants ?

Non. Les chiffres de 43.6% sur FrontierCode / 65.3% sur DeepSWE / 1588 Elo sur WebDev Arena sont fournis par Google pour comparer le 3.7 Flash au 3.6 Flash. Considérez-les comme indicatifs jusqu'à la publication d'évaluations indépendantes tierces.

Guides connexes