ChinaModelAPI

新闻 / 模型观察 · 西方前沿

西方前沿观察 Gemini 3.7 Flash Google 前沿基准
2026-08-19 · 模型观察

Gemini 3.7 Flash:Google 主打代码与 Agent 的主力模型

Google 于 2026 年 8 月 13 日发布了 Gemini 3.7 Flash,称其为针对代码编写、软件工程和 Agent 工作流的“迄今最智能的主力模型”。我们将 Gemini 视作与中国开源模型对照的 西方前沿基准(与 GPT-5.6 Sol、Claude Opus 5 和 Grok 4.6 扮演的角色相同)——以下是关于 Google 实际交付内容及其对国产模型技术栈影响的清晰、有据可查的解读。

核心结论

Gemini 3.7 Flash 于 2026 年 8 月 13 日正式推出——距 Gemini 3.6 Flash 仅相隔三周。 根据 Google 的官方公告和 Gemini API 文档,gemini-3.7-flash 是一个稳定版模型,具备 1,048,576 tokens 的输入上限(约 1M 上下文)和 65,536 tokens 的输出上限, 支持 low/medium/high 思考级别,并提供包括函数调用(function calling)、代码执行、搜索接地(search grounding)和电脑操作(computer use,预览版)在内的 Agent 功能。 限时优惠价格为 每 1M tokens $0.75 / $3.75(仅为 3.6 Flash 首发价的一半),有效期截至 2026 年 12 月 31 日。 注:Gemini 为西方闭源模型,ChinaModelAPI 不提供路由——我们仅将其作为对比基准进行追踪。

Google 官方公告与文档的核心内容(已核实)

我们以官方公告和 API 文档作为事实来源。截至 2026-08-19:

规格参数Gemini 3.7 Flash(官方数据)
模型 IDgemini-3.7-flash · 在 Gemini API 文档中列为稳定版
发布时间2026 年 8 月 13 日(Google 官方博客,产品管理高级总监 Tulsee Doshi)
输入 token 上限1,048,576(约 1M 上下文)
输出 token 上限65,536
输入 → 输出文本、图像、视频、音频、PDF → 文本
思考模式low / medium / high(“minimal” 会报错)
Agent 功能函数调用、代码执行、搜索与 Maps 接地、文件搜索、URL 上下文、结构化输出、上下文缓存、Batch API、Flex/Priority;computer use 处于预览阶段。不支持音频/图像生成及 Live API。
可用渠道Gemini API(AI Studio、Android Studio)、Google Antigravity、Gemini Enterprise Agent Platform(Model Garden)及企业版应用;面向 AI Pro/Ultra 订阅用户的 Spark(覆盖 160 多个国家/地区;不含欧洲经济区、尼日利亚、瑞士、英国)
安全机制针对 CBRN(化生放核)及网络攻击滥用更新了安全防护机制

对比 Gemini 3.6 Flash 的基准测试

Google 官方公告显示,在代码、Agent 和文档推理等基准测试中,该模型相较 3.6 Flash 取得了全面提升:

基准测试3.7 Flash3.6 Flash
FrontierCode 1.1 Main43.6%34.4%
DeepSWE v1.165.3%49.0%
WebDev Arena (Arena.ai) Elo15881538
GDP.pdf34.0%22.0%
AutomationBench (Zapier)30.4%17.0%

数据来自 Google 官方公告中的厂商自测成绩——未经我们独立验证。Google 还指出该模型具备更出色的调试能力、更高的代码一次性通过率、更强的多步规划与工具调用能力,以及在 UI 生成中能更精准地遵循设计规范。

定价与三周快速迭代节奏

Gemini 3.6 Flash 于 2026 年 7 月 21 日发布,3.7 Flash 紧随其后于 8 月 13 日登场——这一节奏引发了英文媒体的高度关注(Ars Technica 称其为“距上一版本发布仅隔三周”)。Google 将这种迭代速度归功于开发者反馈以及计划在未来模型中复用的算法创新。在价格方面:

  • 截至 2026 年 12 月 31 日:输入每 1M tokens $0.75 · 输出每 1M tokens $3.75——仅为 3.6 Flash 首发单价的一半。
  • 2027 年 1 月 1 日起:恢复标准定价,每 1M tokens 输入 $1.50 / 输出 $7.50。
  • 媒体评价:VentureBeat 将此次发布总结为 Google“通过五折限时优惠发力代码与 Agent 领域”。

对国内大模型开发者的启示

Gemini 3.7 Flash 不是 ChinaModelAPI 路由的模型——它属于西方闭源模型。我们在模型观察表中将其作为质量与成本上限的参考基准,正如对 GPT-5.6 Sol、Claude Opus 5 和 Grok 4.6 的定位一样。值得注意的是:它的约 1M 上下文以及激进的首发定价,缩小了国产旗舰模型此前保持的两项明显优势。

计费模式来源 / 接入方式技术栈中的最佳定位
Gemini 3.7 FlashGoogle · 闭源 API西方主力基准(代码 / Agent)
DeepSeek-V4-Pro-0813DeepSeek · 开源权重前沿 Agent/推理、支持私有化部署、成本极低
Qwen3.8-Max阿里 · 开源权重代码编写 & 长流程任务
GLM-5.3 / Kimi K3智谱 / 月之暗面 · 开源1M 上下文长流程任务 & Agent

完整实时对比:国产大模型对比

一手信息来源

FAQ

我可以通过 ChinaModelAPI 调用 Gemini 3.7 Flash 吗?

不支持。Gemini 属于西方闭源模型。ChinaModelAPI 仅路由中国前沿大模型(DeepSeek、Qwen、GLM、Kimi、Seedance、HappyHorse)。我们在此列出 Gemini 3.7 Flash 仅作为横向对比的西方基准。

1M 上下文——是否与国产旗舰模型持平?

从参数上看确实如此:1,048,576 输入 tokens 达到了 DeepSeek-V4-Pro、Qwen3.8、GLM-5.2/5.3 和 Kimi K3 所宣传的 1M 级别。而国产开源权重模型依然支持私有化部署,且单 token 成本通常更低。

$0.75 / $3.75 的价格是永久的吗?

不是——该价格为限时首发特惠,有效期截至 2026 年 12 月 31 日。根据 Google 官方公告,自 2027 年 1 月 1 日起将恢复标准定价:输入每 1M tokens $1.50 / 输出每 1M tokens $7.50。

这些基准测试数据来自独立评测吗?

不是。43.6% FrontierCode / 65.3% DeepSWE / 1588 WebDev Arena Elo 等数据均为 Google 官方公布的 3.7 Flash 与 3.6 Flash 对比自测数据。在第三方评测出炉之前,请仅将其作为参考趋势。

相关指南