Google Gemini 3.7 Flash 发布
TECH

Google Gemini 3.7 Flash 发布

23+
Signals

战略概览

  • 01.
    谷歌宣布推出 Gemini 3.7 Flash,称其为迄今为止最智能的编码与代理工作模型,现已面向 Gemini Spark(AI Pro/Ultra)、Google AI Studio、Android Studio、Gemini Enterprise Agent Platform 和 Gemini Enterprise 应用上线。
  • 02.
    该模型在 Gemini 3.6 Flash 发布仅三周后推出,是继今年5月的 Gemini 3.5 Flash 和7月发布的 3.6 Flash、3.5 Flash-Lite 与 3.5 Flash Cyber 组合之后,三个月内推出的第三个独立的 Flash 级别模型。
  • 03.
    首发价格为每百万输入token 0.75美元,每百万输出token 3.75美元,优惠期持续至2026年12月31日,此后价格将上涨至每百万token 1.50美元和7.50美元。
  • 04.
    谷歌报告称,相比 Gemini 3.6 Flash,在编码和代理任务上的基准测试成绩实现了两位数增长,包括 FrontierCode 1.1 Main(从34.4%提升至43.6%)和 DeepSWE v1.1(从49.0%提升至65.3%)。

一场闪电冲刺,实则掩盖旗舰产品发布停滞

Gemini 3.7 Flash 在 Gemini 3.6 Flash 发布仅三周后便匆匆登场 [1],这是谷歌在三个月内推出的第三个独立的 Flash 级别模型,此前分别是5月的 Gemini 3.5 Flash 和7月的 3.6 Flash / 3.5 Flash-Lite / 3.5 Flash Cyber 组合。对于一家尚未公布其真正旗舰产品 Gemini 3.5 Pro 发布日期的公司而言,如此紧凑的节奏实属异常 [2]。TechCrunch 报道称,7月那批发布中并未包含 3.5 Pro,因为谷歌据称仍在努力使其更大规模的模型达到内部性能目标 [3]

谷歌将 3.7 Flash 的进步归因于模型推理核心的算法调整以及开发者反馈,而非一次全新的预训练过程 [4]。换句话说,这是一次对现有模型家族的调优和后训练升级,而非一个全新的基础模型——这也正是谷歌能够每隔几周而非几个月就推出可见的、能改变基准测试结果的 Flash 更新的原因。对于一家在低成本、高速度代理模型领域面临日益激烈竞争的公司来说,快速迭代的 Flash 产品线是一种维持开发者关注和媒体头条优势的方式,即使更困难的 Pro 级别发布问题仍未解决。

具体提升了什么?数据说话

主要提升集中在编码和代理工具使用方面,而非通用知识。在谷歌自己的基准测试套件中,3.7 Flash 在 FrontierCode 1.1 Main 上的成绩从 3.6 Flash 的34.4%跃升至43.6%,在 DeepSWE v1.1 上从49.0%升至65.3% [5]—— 单次版本更新就在软件工程基准上实现了约16个百分点的飞跃。代理工作流基准的相对提升更为显著:AutomationBench 从17.0%几乎翻倍至30.4%,GDP.pdf 从22.0%升至34.0% [5]。在网页开发方面,Axios 报道 Code Arena: WebDev Elo 分数从1538上升至1588 [6]

独立验证来自 Artificial Analysis,该公司给出 3.7 Flash 的 Intelligence Index 得分为56,而同级别模型中位数仅为34,并测得其输出速度为每秒340.1个token,远超67.5的中位数——这一表现足以使其在188个被追踪模型中速度排名第一,同时智能得分排名第十七 [7]。这种组合使该公司将其描述为达到了“单位任务智能-时间帕累托前沿”——意味着它不像大多数廉价快速模型那样以能力换取速度,而是同时在价格层级内提升了速度与能力。

谷歌自身的演示内容也用实例佐证了这些数字:一段官方演示展示了 3.7 Flash 使用 Chrome MCP 服务器审计一个现有网站,然后自主地循环修复并重新测试,直至在所有类别中均获得完美的 Lighthouse 分数,全程无需进一步人工干预。另一段配套演示展示了该模型在 Google Antigravity 中构建一个完整的精灵游戏,并对构建中途的提示变更做出连贯反应——这些具体案例生动体现了基准测试所衡量的工具调用和设计遵循能力的提升。

折扣有到期日

定价策略很直接:每百万输入token 0.75美元,每百万输出token 3.75美元,此优惠价仅持续至2026年12月31日 [5]。VentureBeat 将此次发布描述为一次针对编码和代理工作负载的大约50%的首发价格下调 [8]。两家具名合作伙伴用具体数据支持了这一说法:Box 报告称新模型在生产环境中既更准确又显著更快,Browser Use 表示基于 3.7 Flash 构建的代理运行成本比 3.6 Flash 低35% [9]

较少被关注的是2027年1月1日会发生什么:届时相同token的价格将跳涨至1.50美元输入和7.50美元输出 [5]—— 完全翻倍。任何基于 3.7 Flash 发布定价来构建生产级代理部署成本模型的团队,实际上都在隐性地接受一个大约四个半月后的中期成本上涨,除非谷歌在此前延长促销或推出更便宜的后续型号——鉴于过去三个月的发布节奏,这并非不可能。

基准热情遭遇‘刷榜’质疑

市场反响热烈且总体积极。谷歌和 DeepMind 自身的发布文章以及独立排行榜追踪机构推动了强劲的首日参与度,评论员的观点甚至超越了谷歌自身的营销定位。Kingy AI 认为 3.7 Flash “是迄今为止最有力的理由,应将谷歌的 Flash 系列视为主力工作模型,而非廉价备选” [10],这一重构值得注意,因为 Flash 历来被定位为低于 Pro 级别的经济选项。

但这种热情并非普遍。社区中有声音强烈的少数派对基准故事提出反驳,认为这些提升是针对谷歌重点突出的特定测试套件进行优化的结果,而非广泛能力的跃升。怀疑者还质疑基准级别的编码和工具使用提升是否能在大规模下转化为可靠的现实世界代理行为,这种担忧早于本次发布,且普遍适用于快速迭代的 Flash 系列。考虑到谷歌已在三个月内发布了三个 Flash 模型,部分此类怀疑实质上提出了一个代理问题:每次发布的改进中,有多少是真正的能力提升,又有多少只是增量调优被包装成了新的版本号。

历史背景

Gemini 3.5 Flash 在2026年谷歌I/O大会上发布,其在编码和代理基准测试上击败了更大的 Gemini 3.1 Pro,同时运行速度更快。
谷歌发布了三款新模型——Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber,再次未随同发布备受期待的 Gemini 3.5 Pro。
Gemini 3.7 Flash 在 Gemini 3.6 Flash 发布三周后推出,而 Gemini 3.5 Pro 仍处于延迟状态并在合作伙伴测试中。

关键关系图

关键玩家
主题

Google Gemini 3.7 Flash 发布

GO

Google DeepMind

Develops and sets pricing/release cadence for the Gemini model family; its decision to keep shipping Flash-tier updates every few weeks, rather than wait for Gemini 3.5 Pro, is the central strategic choice this story turns on.

AR

Artificial Analysis

Independent benchmarking firm whose Intelligence Index and speed rankings are the only third-party validation of Google's benchmark claims cited in this reporting; without it, all performance claims trace back to Google itself.

BO

Box

Enterprise partner reporting the model as more accurate and significantly faster in production, lending real-world credibility to Google's launch claims beyond synthetic benchmarks.

BR

Browser Use

AI agent tooling company reporting 35% lower per-run costs switching from 3.6 to 3.7 Flash, providing the clearest concrete evidence that the pricing/performance gains translate into operational savings.

事实来源

10 条引用
  1. [1] Gemini 3.7 Flash launch
  2. [2] Google Unveils Gemini 3.7 Flash Model as Gemini 3.5 Pro Delay Persists
  3. [3] Google releases three new Gemini models, but no 3.5 Pro
  4. [4] Google launches Gemini 3.7 Flash for coding and AI agent projects
  5. [5] Introducing Gemini 3.7 Flash
  6. [6] Google's Gemini 3.7 Flash
  7. [7] Gemini 3.7 Flash
  8. [8] Google's Gemini 3.7 Flash targets coding and agents with a 50% introductory price cut
  9. [9] Gemini Flash
  10. [10] Gemini 3.7 Flash Review: Benchmarks & Pricing

来源文章

Top 1

THE SIGNAL.

Analysts

评价 Gemini 3.7 Flash 的 Intelligence Index 得分远高于其价格区间的中位数,并指出其达到了‘单位任务智能-时间帕累托前沿’,意味着它同时提升了速度与能力,而非牺牲一方换取另一方。

Artificial Analysis
独立AI模型基准评测机构

发现新模型在实际生产使用中比前代更准确且显著更快。

Box
企业客户/合作伙伴

报告称在 3.7 Flash 上运行代理的成本比前一代 Flash 降低了35%。

Browser Use
AI代理工具公司

认为当前价格下的编码与代理执行能力提升,意味着谷歌的 Flash 系列现在应被视为主力工作模型,而非 Pro 级别模型之下的廉价备选。

Kingy AI
独立科技评测人
The Crowd

Today we're introducing Gemini 3.7 Flash, our most intelligent workhorse model yet for coding and agents. This model brings substantial gains across software engineering, web development, and complex knowledge work. Now through the end of the year, Gemini 3.7 Flash is available...

@@Google4082

Gemini 3.7 Flash is here. It's stronger for coding, knowledge work, and web development.

@@GoogleDeepMind3398

Gemini 3.7 Flash (High) by @GoogleDeepMind just landed in the Code Arena: WebDev and Text Arena! This release is a strong improvement from its previous model Gemini 2.6 Flash (High): #19 -> #8 in the Code Arena: WebDev. By category, it ranks in the top 10 in domains for...

@@arena916

Gemini 3.7 Flash Benchmarks

@u/minxio_544
Broadcast
Introducing Gemini 3.7 Flash

Introducing Gemini 3.7 Flash

Autonomous Web Optimization with Gemini 3.7 Flash

Autonomous Web Optimization with Gemini 3.7 Flash

Gemini 3.7 FLASH? GPT-6 Astra DELAYED, RIP Google AI? ByteDance 10T AI Model, & More! AI NEWS

Gemini 3.7 FLASH? GPT-6 Astra DELAYED, RIP Google AI? ByteDance 10T AI Model, & More! AI NEWS