谷歌Gemini 3.7 Flash的发布
TECH

谷歌Gemini 3.7 Flash的发布

93+
Signals

战略概览

  • 01.
    谷歌于2026年8月13日发布了Gemini 3.7 Flash,称这是其迄今为止最智能的编程与智能体工作模型。
  • 02.
    此次发布距离2026年7月21日推出的Gemini 3.6 Flash仅三周时间,延续了谷歌加速发布模型的节奏。
  • 03.
    在2026年12月31日之前,入门价格为每百万输入令牌0.75美元、每百万输出令牌3.75美元——仅为Gemini 3.6 Flash发布价格的一半——随后将于2027年1月1日起上调至每百万令牌1.50美元/7.50美元。
  • 04.
    Gemini 3.7 Flash可通过Google AI Studio、Android Studio、Google Antigravity、Gemini企业智能体平台以及Spark使用,同时也可在包括OpenRouter和Devin在内的第三方平台上获取。

三周冲刺,并非巧合

Gemini 3.7 Flash于2026年8月13日上线,距离7月21日发布的Gemini 3.6 Flash仅23天——这一周转时间即使按谷歌近期标准也异常紧凑,媒体报道将其视为已加速发布节奏的延续[1]。谷歌对此跃升的解释颇具深意:公司表示性能提升来自开发者反馈和算法创新,而非新一轮预训练[1]。这一区别至关重要。从头训练一个新基础模型需要数月的计算资源和规划;而调整现有模型的推理方式则相对便宜且快速——这正是在竞争压力下的公司会优先采取的手段。

这种压力并不隐晦。此次发布恰逢谷歌内部传出AI领导层动荡和员工离职的消息,分析人士明确将此次发布解读为针对Anthropic和OpenAI的产品执行回应,而非例行模型更新[2]。将3.7 Flash的编码评测结果直接与Claude Sonnet 5和GPT-5.6 Terra进行比较的报道进一步强化了这一叙事[3]。在X平台上,速度本身已成为营销信息:谷歌DeepMind研究主管Koray Kavukcuoglu将Gemini从3.5到3.7仅用三个月的跨越,描述为内部迭代加速的证据,这一信息也被谷歌官方和AI Studio账号推广。然而,这种节奏对必须每几周就重新集成一次新默认模型的团队和平台而言是否可持续,是另一个问题。

现在半价,明年翻倍

其经济策略与发布节奏一样激进。Gemini 3.7 Flash以每百万输入令牌0.75美元、每百万输出令牌3.75美元的价格推出——仅为三周前发布的3.6 Flash价格的一半[4]。在OpenRouter上,额外50%的促销折扣使有效价格进一步降至每百万令牌0.375美元/1.875美元,持续至8月27日,并附带1,048,576令牌的上下文窗口[5]。多家媒体将此举描述为谷歌加剧了行业范围内的价格战,该战局已包括OpenAI的'Ultrafast'和DeepSeek的V4-Pro模型[6]

但折扣有到期日。自2027年1月1日起,价格将翻倍至每百万令牌1.50美元/7.50美元[7],这意味着任何基于当前价格制定产品路线图的团队,实际上是在依赖一个五个月后将不复存在的费率。这种“现在便宜、未来更贵”的张力催生了一种在开发者在线讨论中反复出现的战略解读:Flash层级的模型可能并非为了赢得智能排行榜,而是为了让谷歌自身最高流量、最低利润率的服务——如搜索中的AI概览和Gemini应用的免费版——在所需规模上运行时仍具成本效益。在此视角下,在基准测试中击败Claude Sonnet 5只是一个不错的标题,而Gemini 3.7 Flash的真正任务可能是保持足够低廉和快速,以支撑海量查询而不亏损。

基准测试实际显示了什么

原始分数的提升是真实的。在DeepSWE v1.1编码基准测试中,Gemini 3.7 Flash得分为65.3%,而Gemini 3.6 Flash为49.0%[8];在FrontierCode 1.1中,从34.4%提升至43.6%[4];在围绕真实业务工作流构建的AutomationBench套件中,从17.0%跃升至30.4%——几乎是Claude Sonnet 5在同一测试中10.7%得分的三倍[8]。在WebDev Arena中,Gemini 3.7 Flash的Elo得分为1588,略高于Claude Sonnet 5(1541)和GPT-5.6 Terra(1523)[8]

但这并不意味着3.7 Flash是通吃赢家,报道对此也持谨慎态度。在OSWorld-2.0这一更难的智能体计算机使用测试中(模型需操作桌面环境而不仅是编写代码),Gemini 3.7 Flash落后于GPT-5.6 Terra[9],而在更广泛的知识工作评估中,Claude Sonnet 5在某些方面仍占优[10]。诚实的总结比‘谷歌Flash模型击败前沿’更窄:这意味着Gemini 3.7 Flash在编码和智能体工作流任务上已大幅缩小差距,且成本仅为几分之一,但在一些最难、最开放的智能体基准测试中仍落后。

怀疑者有道理,早期采用者也有话说

Reddit上的反应沿可预测的路线分裂。庆祝派认为‘3.7 Flash太快了……几乎比大模型快两倍,也便宜得多’,有用户引用DeepSWE从3.5 Flash的37%跃升至3.7 Flash的65%;而怀疑的少数派则反驳称‘除非被证实,否则视为基准测试优化’,并指出根据谷歌自身公布的数据,3.7 Flash仍落后于多个中国开源模型。另一类抱怨与基准测试无关:一些用户报告该模型在代码超过约2,000行后失去连贯性,并认为Gemini模型在真实智能体工作流中部署时扩展性差——有评论甚至表示,除非延迟低于一秒,否则无论排行榜位置如何,模型对智能体工作都无用。

早期企业采用者讲述的故事比任何一方都更具体。法律AI公司Harvey在其自身的Legal Agent Bench上测试了3.7 Flash,报告得分为90.7%,在真实法律工作流任务上比3.6 Flash高出2.6个百分点[8]。Nunu.ai联合创始人Kyrill Hux在Figma转代码任务中测试该模型,称其在视觉保真度上‘其他前沿模型难以企及’,成本约为GPT-5.6 Terra的一半[8]。Cognition的Devin则集成了该模型,发现其在范围明确、差异小且符合现有仓库规范的重构任务中表现最佳——这一认可比‘击败前沿’更窄、更具体,且与基准数据的吻合度高于单纯的炒作或怀疑[11]

历史背景

Gemini 3.6 Flash作为上一代‘工作马’模型以每百万输入/输出令牌1.50/7.50美元的价格推出,同期还有Gemini 3.5 Flash-Lite和Gemini 3.5 Flash Cyber。
Gemini 3.7 Flash在Gemini 3.6 Flash发布仅23天后推出,标志着Flash模型系列发布节奏的加速。
此次发布发生在谷歌传出AI领导层动荡和人才流失的背景下,分析人士将此次发布解读为对Anthropic和OpenAI竞争压力的产品执行回应。

关键关系图

关键玩家
主题

谷歌Gemini 3.7 Flash的发布

事实来源

12 条引用
  1. [1] Gemini 3.7 Flash launch: Google's accelerated cadence continues
  2. [2] Google launches Gemini 3.7 Flash amid AI leadership shakeup
  3. [3] Google launches Gemini 3.7 Flash, which beat Sonnet 5 and GPT-5.6 in coding evals
  4. [4] Gemini 3.7 Flash lands with coding gains and undercuts its three-week-old predecessor's price by 50%
  5. [5] Gemini 3.7 Flash on OpenRouter
  6. [6] Google joins the AI model price war with the new Gemini 3.7 Flash
  7. [7] Gemini 3.7 Flash brings coding-agent gains and a price cut
  8. [8] Gemini 3.7 Flash launches at half price with major DeepSWE gains
  9. [9] AI Models: Google Gemini 3.7 Flash, OpenAI Ultrafast, DeepSeek V4 Pro
  10. [10] Google cuts Gemini 3.7 Flash price in half, claims it tops Claude in business workflows
  11. [11] Gemini 3.7 Flash review
  12. [12] Introducing Gemini 3.7 Flash

来源文章

Top 5

THE SIGNAL.

Analysts

报告称Gemini 3.7 Flash在Harvey的Legal Agent Bench上比Gemini 3.6 Flash的全通过性能高出2.6个百分点,表明在真实法律工作流任务上取得了可衡量的提升。

Niko Grupen
应用研究主管,Harvey

表示该模型的基准测试使其在约一半成本下达到中型前沿模型水平,并特别赞扬其在将Figma设计精确转换为代码时的效率和准确性,其他前沿模型在视觉保真度上难以匹敌。

Kyrill Hux
联合创始人,Nunu.ai

评估此次发布将谷歌Flash系列从预算备选提升为主要工作模型,鉴于其在编码和智能体任务上的提升及价格优势。

Kingy AI
行业评测媒体
The Crowd

Today we're introducing Gemini 3.7 Flash, our most intelligent workhorse model yet for coding and agents. This model brings substantial gains across software engineering, web development, and complex knowledge work. Now through the end of the year, Gemini 3.7 Flash is available

@@Google6138

introducing Gemini 3.7 Flash: our most intelligent workhorse model yet for coding and agents this release comes just three weeks after Gemini 3.6 Flash, and is a direct result of developer feedback and algorithmic innovations that we look forward to bringing to future models

@@GoogleAIStudio5036

Today we're launching Gemini 3.7 Flash - our latest workhorse model for coding and agentic workflows, with an introductory price at half the original cost of 3.6 Flash. ⚡️ We have been iterating rapidly with the Flash series, going from 3.5 to 3.7 in just 3 months, making it

@@koraykv2306

3.7 flash passed the ultimate test

@u/Grand-Bit-72971100
Broadcast
Introducing Gemini 3.7 Flash

Introducing Gemini 3.7 Flash

Autonomous Web Optimization with Gemini 3.7 Flash

Autonomous Web Optimization with Gemini 3.7 Flash

Gemini 3.7 Flash - Benchmark and Pricing | How to Use Online

Gemini 3.7 Flash - Benchmark and Pricing | How to Use Online