AI模型价格崩盘,注意力转向Gemini 3.5
TECH

AI模型价格崩盘,注意力转向Gemini 3.5

20+
Signals

战略概览

  • 01.
    谷歌于2026年5月19日至20日在Google I/O大会上推出Gemini 3.5 Flash,每百万输入token定价1.50美元,每百万输出token定价9美元,相比其取代的Gemini 3 Flash层级(0.50美元 / 3美元)上涨约3倍。
  • 02.
    DeepSeek在2026年将其旗舰V4-Pro的价格永久下调75%,定价约为每百万输入token 0.44美元,输出为0.87美元,大幅低于GPT-5、Opus 4.7和Gemini Flash。
  • 03.
    据《华尔街日报》报道,OpenAI正考虑对开发者和企业实施大幅降价,以应对Anthropic的类似举措,而两家公司均已秘密提交IPO申请。
  • 04.
    企业客户正在收紧AI支出,从‘tokenmaxxing’转向效率优先,这一转变可能即使在每token价格下降的情况下,仍会减缓OpenAI和Anthropic的收入增长。

深度分析

崩盘只是故事的一半——谁在降价,谁在悄然提价

AI模型价格正在崩盘这一标题在市场的一侧是真实的,在另一侧却是错误的。在降价方面,DeepSeek将其旗舰V4-Pro的价格永久下调75%,使其定价接近每百万输入token 0.44美元、输出0.87美元——这一价格远低于GPT-5、Opus 4.7和Gemini Flash [1]。Anthropic也紧随其后,将Opus价格从每百万15美元降至5美元,降幅约67% [2]。据《华尔街日报》报道,OpenAI也在考虑自身大幅降价,以应对秘密IPO前的竞争压力 [3]

但市场翘首以盼的模型却走向相反方向。谷歌Gemini 3.5 Flash以每百万输入1.50美元、输出9美元的价格推出——相比其取代的Gemini 3 Flash层级上涨约3倍 [1]。有报告指出,西方AI补贴定价的时代正在结束,认为此前的低价本就不可持续 [1]。因此,真实图景是一个两极分化的市场:开源模型实验室正在压低价格底线,而前沿层级则在悄然抬高天花板。若将此简单视为全面崩盘,将忽略真正的竞争格局——便宜的token和昂贵的token正在同时拉开差距。

每token便宜,每答案昂贵——正在摧毁预算的悖论

本轮周期中最被低估的事实是:token价格与账单总额正在脱钩。在两年内,固定能力的推理成本已下降约95%——GPT-4级别的输出从2023年的每百万输入token约30美元,降至2026年的不足0.50美元 [4]。Epoch AI指出,整体趋势的中位数为每年便宜约50倍,2024年1月后测量的基准甚至达到200倍 [5]。从任何单位指标看,智能从未如此便宜。

然而账单却在飙升。据报道,企业AI平均预算从2024年的约120万美元/年增长至2026年的700万美元/年,因为智能体工作负载每项任务消耗的token数量大幅增加 [6]。这正是悖论所在:每个token几乎免费,但一个智能体‘答案’现在却要消耗数千个token,用于工具调用链、重试和长上下文推理。结果正如CNBC所报道,市场正从‘tokenmaxxing’——将token用于所有问题——转向严格效率管理,企业开始计量使用量,并将低成本任务路由至最便宜的供应商 [7]。对OpenAI和Anthropic而言,这种行为转变意味着即使标价下降,仍面临收入风险 [7]

为何战争此时爆发——DeepSeek、IPO压力与Gemini倒计时

三大因素在2026年中旬交汇,成为引爆点。首先是开源模型的竞争:中国实验室正以极低成本推出与前沿模型相当的产品——DeepSeek的成本约为封闭替代品的十三分之一——迫使西方供应商降价或失去市场份额 [3]。其次是即将来临的流动性事件:OpenAI和Anthropic均已秘密提交IPO申请,其背后数据严峻:OpenAI 2026年第一季度经调整营业利润率据报为-122%,其在全球生成式AI网页流量中的份额从2025年5月的77.6%降至2026年4月的53.7% [3]。在上市前捍卫市场份额已成为战略要务。

第三个因素是市场预期本身。随着行业等待谷歌下一代Gemini发布,各实验室正积极为新模型定价并释放降价信号,以在发布前锁定开发者 [3]。在价格战表象之下,真正的推动力来自工程技术——Epoch AI将价格下降归因于硬件升级(如H100到Blackwell)和算法效率提升(如量化、推测解码和专家混合路由) [5]。竞争的导火索是商业的,但弹药却是技术的。

怀疑者看到了什么——捆绑与总成本才是真正的战场

远离基准图表,实践者社区对此的看法并非价格崩盘,而是一场尚无赢家的战斗。开发者中的主流观点是,表面的每token价格仍低于真实成本,这正是为何同一批供应商面临提高使用限制或悄悄削减用量上限的压力——所谓的‘崩盘’部分掩盖了目前尚无明确盈利方的事实。Delphi Ventures的Tommy Shaughnessy直白地指出其底层经济逻辑,认为20美元/月的固定费用定价始终低于高使用量的实际成本 [3]

更具战略性的解读是,真正的武器根本不是token价格,而是捆绑销售和总体拥有成本。普遍观点认为,谷歌可以将强大模型与Workspace、存储和其他消费产品打包,以单一订阅价吸引用户,这种经济模式是纯AI实验室无法匹敌的。产品运营者认为谷歌的优势在于掌控全栈——芯片、数据中心和搜索现金流——使其能同时在低价和高端市场展开竞争。讨论中的张力真实存在:一方面是对竞争终于压低价格的真诚欢迎,另一方面则是对当前价格是否反映可持续经济模式的深刻怀疑,而非一场补贴驱动的圈地运动。

历史背景

Epoch AI分析发现,跨基准测试,LLM推理价格每年下降9至900倍,中位数约为每年50倍,2024年1月后加速下降。
Gemini 3.5 Flash于2026年Google I/O大会发布,价格较前代上涨约3倍,打破了此前价格持续下降的趋势。
CNBC报道称企业正从‘tokenmaxxing’转向效率优先,并举例Uber在四个月内耗尽全年AI预算,Lindy将全部流量转向DeepSeek。

关键关系图

关键玩家
主题

AI模型价格崩盘,注意力转向Gemini 3.5

GO

Google

Frontier lab that raised Gemini 3.5 Flash pricing ~3x while positioning it as its default workhorse model, signaling Western labs are nudging prices up rather than uniformly collapsing them.

OP

OpenAI

Weighing steep developer and enterprise price cuts amid Anthropic's growth and open-source competition; its Q1 2026 adjusted operating margin was reported at -122%.

AN

Anthropic

Cut Opus pricing from $15 per million (Opus 4.1) to $5 per million, a roughly 67% reduction, while its annualized run rate grew from $9B at end 2025 to $47B by May 2026.

DE

DeepSeek

Chinese lab whose permanent 75% price cut on V4-Pro matches frontier benchmarks at a fraction of the cost, forcing Western labs to rethink their pricing.

事实来源

7 条引用
  1. [1] Google Gemini 3.5 Flash costs 3x the model it replaced, and cheap AI may be ending
  2. [2] AI price war begins: the OpenAI and Anthropic dilemma
  3. [3] OpenAI wants a price war with Anthropic as DeepSeek and China close in
  4. [4] How AI inference costs have dropped 95% in two years and what happens next
  5. [5] LLM inference price trends
  6. [6] The AI inference cost crisis of 2026
  7. [7] OpenAI and Anthropic face a new AI reality as users shift from tokenmaxxing to efficiency

来源文章

Top 1

THE SIGNAL.

Analysts

暗示OpenAI将在价格战压力下找到方法,让客户以更少支出获得更高价值:'我认为我们会有很多方式帮助人们以更少支出获得更高价值。'

Sam Altman
CEO, OpenAI

认为消费者固定费用定价始终低于高使用量的真实成本:'20美元/月的固定费率始终低于高使用量的实际成本。'

Tommy Shaughnessy
Delphi Ventures
The Crowd

(1) Today we're releasing Muse Spark 1.1 -- a strong agentic and coding model at a very low price. It's available through our new Meta Model API and in Meta AI.

@@finkd44995

Gemini 3.5 Pro Benchmark Leak -Reportedly outperforming Claude Fable 5 and GPT-5.6 in internal evaluations -Gemini 3.5 Pro Currently undergoing private validation and testing -Significant zero-shot performance improvements -they are Targeting a July 17 launch -Gemini 3.5 Pro

@@Mr_Salio1079

🚨 Google delays Gemini 3.5 Pro again ! - Google has delayed the next Gemini Pro model a second time: · Now targeting end of July or later · Full new pre-training run on fresh base model · 2M token context window · Deep Think extended reasoning mode - From leaks the model

@@LuminaXspace728

Google just fired a warning shot in the AI subscription price wars

@u/Logical_Welder34671700
Broadcast
AI Prices Are About to Shock Everyone

AI Prices Are About to Shock Everyone

Google unveils 'Gemini 3 Flash' AI model focused on speed and cost

Google unveils 'Gemini 3 Flash' AI model focused on speed and cost

Gemini 3 Flash: The "Budget" Model That's DESTROYING Premium AI (And It's Free)

Gemini 3 Flash: The "Budget" Model That's DESTROYING Premium AI (And It's Free)

AI模型价格崩盘,注意力转向Gemini 3.5 — AI 新闻 | Agentic Brew