Google的Gemini 3.6 Flash发布
TECH

Google的Gemini 3.6 Flash发布

23+
Signals

战略概览

  • 01.
    Google于2026年7月21日发布了三款新的Gemini模型:Gemini 3.6 Flash、Gemini 3.5 Flash-Lite和Gemini 3.5 Flash Cyber,其中3.6 Flash接替3.5 Flash成为Google的主力模型。
  • 02.
    Gemini 3.6 Flash的定价为每100万输入token 1.50美元,每100万输出token 7.50美元,相比3.5 Flash减少了17%的输出token使用量;而Gemini 3.5 Flash-Lite的运行速度为每秒350个输出token,每100万输入token 0.30美元,每100万输出token 2.50美元。
  • 03.
    Gemini 3.5 Flash Cyber是一款专注于安全的变体,经过训练可发现、验证并修复Google CodeMender代理中的代码漏洞,目前仅限政府机构和部分可信合作伙伴使用。
  • 04.
    Gemini 3.5 Pro仍处于合作伙伴测试阶段,尚未确认发布日期,且Google透露已启动其迄今为止最雄心勃勃的Gemini 4预训练工作。

更快更便宜,但独立基准测试称并未更聪明

Google对2026年7月21日发布的官方说法是效率提升:根据Artificial Analysis Index,Gemini 3.6 Flash相比3.5 Flash减少了17%的输出token使用量,Google称在某些编码基准测试中token消耗最多减少了65% [1],定价为每100万输入token 1.50美元,每100万输出token 7.50美元 [1]。Gemini 3.5 Flash-Lite是两款公开定价模型中成本最低的,运行速度为每秒350个输出token,每100万输入token 0.30美元,每100万输出token 2.50美元 [3]。Google自身的编码基准测试显示相比上一代有显著提升:DeepSWE代码编辑准确率从37%提升至49%,MLE Bench从49.7%提升至63.9% [2],OSWorld-Verified从78.4%提升至83.0% [1]。但这些是编码工作流和效率指标,而非通用智能评分,这正是独立观察者所关注的差异。AlphaSignal运行了其私有的调试测试集——在13项任务中对比8个其他前沿模型——Gemini 3.6 Flash在9个模型中排名第7,修复了65次尝试中的60次,但总token消耗量高于多个竞争对手。社区基准比较发现,3.6 Flash的智能水平与3.5 Flash基本持平,明显落后于Grok 4.5和GLM等竞争对手。Unite.AI的Jonas Reeve总结了战略判断:Google正在Flash层级上以价格和速度竞争,而‘真正能挑战市场顶端的模型仍未面世,而竞争对手已陆续发布’ [4]。若将其视为一次‘tick-tock’周期——交替发布以效率换取智能提升的版本——此次发布属于效率提升的一半:对高吞吐量的代理和编码工作负载确实有用,但并非某些人期待的前沿能力飞跃。

Pro的空缺与对Gemini 4的押注

此次发布更引人关注的是未发布的内容。本应挑战OpenAI和Anthropic旗舰模型的Gemini 3.5 Pro已多次延期——最初目标为2026年6月,后据报推迟至7月17日,原因是‘全面重建’ [5][6],另有报道称延迟与编码性能不足有关 [7]。截至7月21日的公告,Google表示3.5 Pro仍处于合作伙伴测试阶段,无明确发布日期 [1][2]。同一篇公告中,Google透露,用其自己的话说,‘我们已启动迄今为止最雄心勃勃的预训练运行’以开发Gemini 4 [2]——Reeve认为这更多是意图声明而非已交付的能力 [4]。实际影响非同寻常:目前,Flash层级的模型在多个基准测试中成为Google最强的现役产品,尽管公司路线图将其视为中端选项,导致需要峰值推理能力的开发者仍在等待一个已错过两个目标日期的Pro版本。

一项未能站住脚的知识截止声明

Google的发布材料宣称Gemini 3.6 Flash的知识截止日期从2025年1月推进至2026年3月 [2]。这一具体且可验证的声明遭到了Reddit上一个广受点赞的帖子(r/GeminiAI,‘Gemini 3.6 is a beast bro’)的质疑,发帖者称在禁用网络搜索的情况下询问模型接近其声明截止日期的事件时,模型并未表现出对那段时间事件的了解,并声称Google已悄悄将AI Studio模型卡片中的截止日期字段改为‘unknown’。这些说法源自单一社交媒体帖子,并非媒体报道或Google官方沟通,且此处未独立验证——但该事件引发了更广泛的社区讨论,涉及宣传的训练数据截止日期与模型实际回忆能力之间的差距,以及较新的Gemini版本是否依赖检索来掩盖静态知识边界。这是一个小案例,说明当发布声明做出具体且易验证的主张时,Google面临的信誉风险——尤其当这一主张与‘更快更便宜而非更聪明’的更大叙事同时出现时,即使最尖锐的反驳本身尚未确认。

对批评的反批评

反应明显分为两派。官方渠道和面向开发者的演示强调纯粹的效率信息——Google自己的发布文章宣传3.6 Flash能在相同成本下提供更高质量的工作,第三方工具如GitHub Copilot也在同日将该模型作为可选选项 [8]。在社区方面,主流观点是‘更低的智能换来更高的成本’——尽管营销语言如此,智能评分持平甚至倒退。但另一股反向声音反驳了这种集体批评,认为Google因其他实验室同样存在的权衡而被单独针对,而务实的用户表示会将日常任务分配给3.6 Flash,仅在难题上使用更重的模型。总体图景是一个高效且更便宜的主力模型在人们对‘更快更便宜’是否被过度宣传为‘更好’的真实怀疑中面世。

历史背景

Google宣布推出Gemini 3 Pro。
Gemini 3 Flash发布并成为Gemini应用中的默认模型。
Gemini 3.5 Flash在2026年Google I/O大会上推出,在编码和代理基准测试中表现优于更大的Gemini 3.1 Pro,且每秒输出token速度大约快4倍。
9to5Google报道称Gemini 3.5 Pro因编码性能不足而进一步延迟,而升级版Flash模型已在测试中。
Google正式推出三款新的Flash层级模型,同时确认Gemini 3.5 Pro仍处于合作伙伴测试阶段,无明确发布日期。

关键关系图

关键玩家
主题

Google的Gemini 3.6 Flash发布

GO

Google DeepMind / Gemini团队

Gemini模型家族的开发者和发布者;推出了Flash层级升级,而其旗舰Pro模型仍延迟。

TU

Tulsee Doshi,高级产品管理总监

Google三款新模型官方发布声明的署名作者。

使用

使用Google AI Studio、Android Studio、Antigravity和Gemini企业代理平台的开发者与企业

廉价、快速的Flash层级模型的主要用户,用于代理编码和高吞吐量工作负载。

政府

政府机构和部分合作伙伴

通过CodeMender安全代理独家早期访问Gemini 3.5 Flash Cyber的群体。

OP

OpenAI (GPT-5.6 Luna) 和 xAI (Grok 4.5)

被引用为在重编码基准测试中优于Gemini 3.6 Flash的竞争前沿模型提供商,尽管Gemini在长上下文检索和基于图表的推理方面领先。

事实来源

8 条引用
  1. [1] Introducing Gemini 3.6 Flash, 3.5 Flash-Lite, and 3.5 Flash Cyber
  2. [2] Gemini 3.6 Flash Launch Details
  3. [3] Google Gemini 3.6 Flash Launch
  4. [4] Google Ships Three Gemini Flash Models as Its Flagship Slips
  5. [5] Gemini 3.5 Pro Targets July 17 After Full Rebuild
  6. [6] Google Gemini 3.5 Pro Delay
  7. [7] Gemini 3.5 Pro Delays Reported
  8. [8] Gemini 3.6 Flash Now Available in GitHub Copilot

来源文章

Top 5

THE SIGNAL.

Analysts

认为Gemini 3.5 Pro已远超预期窗口期,Google目前在Flash层级上以价格和速度竞争而非原始能力,指出‘真正能挑战市场顶端的模型仍未面世,而竞争对手已陆续发布’,并将Gemini 4的预训练披露视为意图声明而非已交付的能力。

Jonas Reeve
认知AI与AGI,AI研究代理,Unite.AI
The Crowd

We're rolling out three new models to make AI agents faster, smarter, and cheaper at scale: 🔵 Gemini 3.6 Flash: It uses fewer tokens than 3.5 Flash to deliver higher quality work at the exact same cost. 🔵 Gemini 3.5 Flash-Lite: A fast, cost-effective option for everyday tasks

@@GoogleDeepMind3395

Watch a multi-agent system built with Gemini 3.6 Flash iterate on playable game design in real time. It uses Gemini 3.5 Flash-Lite to design, construct, and verify puzzle challenges based on live player actions balancing speed and reasoning in a fast-paced environment.

@@googleaidevs98

Google says Gemini 3.6 Flash is faster, smarter, and cheaper. But how does it compare with other frontier models when fixing real bugs? We tested it on 13 private debugging tasks. The results were mixed: > Ranked 7th among 9 models > Fixed 60 of 65 attempts > Used more total

@@AlphaSignalAI16

Gemini 3.6 Flash is in a league of its own. Less intelligence for more money.

@u/jd_3d1700
Broadcast
Gemini 3.6 Flash is Here But It's Not Great, Where's 3.5 PRO?

Gemini 3.6 Flash is Here But It's Not Great, Where's 3.5 PRO?

Google Gemini's New Models Just Changed EVERYTHING! (Gemini Flash 3.6 & More)

Google Gemini's New Models Just Changed EVERYTHING! (Gemini Flash 3.6 & More)

Gemini 3.6 Flash: Don't Believe the Benchmarks

Gemini 3.6 Flash: Don't Believe the Benchmarks

Google的Gemini 3.6 Flash发布 — AI 新闻 | Agentic Brew