OpenAI 在中国 AI 价格战中大幅下调 GPT-5.6 价格
TECH

OpenAI 在中国 AI 价格战中大幅下调 GPT-5.6 价格

34+
Signals

战略概览

  • 01.
    OpenAI 下调了其 GPT-5.6 系列产品的价格:最小、最快的 Luna 模型降价 80%,中端 Terra 模型降价 20%,而 Sol 模型价格保持不变,但新增了一项付费‘快速模式’,运行速度最高可达 2.5 倍。
  • 02.
    此次降价发生在 2026 年 7 月下旬,大约在月之暗面(Moonshot AI)于 7 月 16 日发布 Kimi K3 两周后——这是一款拥有 2.8 万亿参数的模型,号称是迄今为止发布的最大开源权重 AI 模型。
  • 03.
    OpenAI 公开将此举描述为持续推动成本效率、能力和速度的体现;但独立分析师和媒体报道普遍认为,这实际上是针对日益激烈的中国竞争所采取的防御性回应。
  • 04.
    此次降价使 GPT-5.6 Luna 进入了 Artificial Analysis 智能每美元价值排名中的‘最具吸引力’层级,超越了中国竞争对手智谱 AI 的 GLM-5.2 和 MiniMax 的 M3。

深度分析

决定一切的两周

在 OpenAI 降价前两周,月之暗面(Moonshot AI)于 2026 年 7 月 16 日发布了 Kimi K3——一款拥有 2.8 万亿参数的模型,号称是迄今为止发布的最大开源权重 AI 模型,每百万输出 token 定价约 15 美元。[1][2]这一发布并非孤立事件:2025 年 1 月,DeepSeek 发布 V3 和 R1 模型,首次证明中国实验室能够以极低的成本实现与西方前沿模型相当的性能;随后,Z.ai 于 2026 年 6 月推出 GLM-5.2,每百万输出 token 定价约 4.40 美元。[2]到 Kimi K3 发布时,这种模式已足够熟悉,市场立即做出反应——Nvidia 在随后几天内市值蒸发约 6000 亿美元,重现了 2025 年初的‘DeepSeek 冲击’。[2]在这一背景下,OpenAI 于 7 月 30 日宣布的 GPT-5.6 降价措施,看起来更像是一场已持续一年半的价格战中的最新动作,而非一次常规路线图更新。

效率提升,还是只是追赶

OpenAI 自身的表述刻意低调:‘我们致力于在成本效率、能力和速度方面持续推进模型前沿。从今天起,我们将 GPT-5.6 Luna 的价格降低 80%,GPT-5.6 Terra 的价格降低 20%。’[1]公司确实指出了数字背后的真正工程进展——GPU 软件优化使部署成本降低了 20%,推测性解码使 token 生成速度提升了超过 15%。[3]但这一说法正面临公开质疑。EMARKETER 高级分析师 Jacob Bourne 认为,这些降价实际上是企业对失控的 AI 账单的反弹,他明确表示‘tokenmaxxing 时代已经结束’。[4]开发者社区对这一公告的讨论也充满怀疑,反复出现的问题不是价格是否够好——显然够好——而是‘效率提升’是否真的是解释,还是对两周前 Kimi K3 发布以及更广泛的中国低价模型浪潮的一种更易接受的防御性说辞。

定价背后的逻辑:为何 Luna 被腰斩而 Sol 没有

此次降价并非均匀分布,这种不对称性正是故事所在。Luna 是该系列中最小、最快的模型,价格下降了 80%——从每百万输入/输出 token 约 1/6 美元降至 0.20/1.20 美元。中端模型 Terra 仅降价 20%,从 2.50/15 美元降至 2/12 美元。旗舰型号 Sol 则完全保持原价,而是新增了一项‘快速模式’,运行速度最高可达 2.5 倍,价格翻倍。[1]这是一种有针对性的回应,而非全面折扣:Luna 正好处于 Kimi K3(每百万输出 token 15 美元)、Z.ai 的 GLM-5.2(每百万输出 token 4.40 美元)和 DeepSeek-V4-Pro(每百万输出 token 0.87 美元)在价格上竞争最激烈的层级,而 Sol 则在原始能力上竞争,中国竞争对手尚未在此领域追上。[2]这一策略至少在一项指标上奏效了:Artificial Analysis 的智能每美元价值排名现在将 GPT-5.6 Luna 列入‘最具吸引力’层级,高于智谱 AI 的 GLM-5.2 和 MiniMax 的 M3。[5]

标价之下的冰山

token 价格是登上头条的数字,但它并不是决定 AI 部署是否真正负担得起的关键数字。营销高管兼董事会顾问 Matteo Cellini 直言不讳:‘token 价格只是成本结构中最小、最可见的一角,而大部分成本是隐形的。’[6]正是这种隐形结构正在给企业预算带来压力——据报道,Uber 在 2026 年第一季度就烧光了其全年 AI 预算,而微软据称在数月内超出年度配额后已暂停使用 Claude Code。[6]Harness 对约 700 名 finops 领导者的调查显示,29% 的组织现在将超过四分之一的云支出归因于 AI,而 42% 的组织每季度才审查一次这些成本,尽管支出每周都在波动。[6]80% 的 token 折扣有所帮助,但它并未触及编排、重试、上下文窗口,以及季度预算与每周现实之间的差距——这正是为什么对此公告的反应更多是松了一口气,而非真正安心。

出口管制是否反而助长了本欲遏制的对手

这场价格战背后隐藏着一个地缘政治上的讽刺。DGA-Albright Stonebridge Group 的 Paul Triolo 认为,‘中国的 AI 生态系统可能比人们想象的要强大得多’,而 Asia Group 的 George Chen 更进一步指出,美国旨在减缓中国 AI 发展的芯片和技术出口限制实际上适得其反:‘限制最新型号的决定真的适得其反了。’[2]数据支持这一观点——中国模型目前占美国公司通过 OpenRouter 运行的 token 的 57%,Airbnb、Cursor、Coinbase 和 DoorDash 等公司均已采用这些模型。[2]从这一角度看,OpenAI 的降价不仅仅是抽象地与 Kimi K3 竞争——它们正试图夺回已经流失的市场份额。

历史背景

推出针对中国的 AI 芯片出口管制政策,该政策后来被指加速了中国本土 AI 的发展。
发布 V3 和 R1 模型,确立了低成本中国 AI 模型的模板,引发了早期市场震荡。
发布 GLM-5.2,每百万输出 token 定价约 4.40 美元,加剧了低成本中国模型的浪潮。
发布 Kimi K3,这是迄今为止参数最多的开源权重 AI 模型,达 2.8 万亿参数。
Kimi K3 发布后市场反应剧烈,出现新一轮‘DeepSeek 冲击’;Nvidia 在随后几天内市值蒸发约 6000 亿美元。
宣布 GPT-5.6 Luna(-80%)和 Terra(-20%)降价,同时为 Sol 推出快速模式,时间点在 Kimi K3 发布约两周后。

关键关系图

关键玩家
主题

OpenAI 在中国 AI 价格战中大幅下调 GPT-5.6 价格

OP

OpenAI

Announced the price cuts and Fast mode for the GPT-5.6 family, attributing them to internal efficiency gains.

MO

Moonshot AI

Beijing lab founded by Yang Zhilin; released Kimi K3, a 2.8-trillion-parameter open-weight model priced around $15 per million output tokens, on July 16, 2026 - roughly two weeks before OpenAI's cuts.

Z.

Z.ai

Released GLM-5.2 in June 2026, priced around $4.40 per million output tokens.

DE

DeepSeek

Hangzhou lab whose V3/R1 releases in early 2025 set the template for low-cost Chinese competition; DeepSeek-V4-Pro is priced around $0.87 per million output tokens.

AR

Artificial Analysis

Third-party benchmarking firm whose intelligence-per-dollar rankings placed GPT-5.6 Luna in the 'most attractive' tier after the cuts, above Chinese rivals GLM-5.2 and M3.

EN

Enterprise customers (Uber, Microsoft)

Cited as examples of companies hitting AI budget limits, pressuring vendors toward lower prices.

事实来源

6 条引用
  1. [1] OpenAI Slashes GPT-5.6 Prices by Up to 80% as AI Cost War Heats Up After Moonshot AI's Kimi K3 Release
  2. [2] China's Moonshot, DeepSeek, Z.ai Challenging US AI on Cost
  3. [3] OpenAI Goes Full China Pricing Mode With an 80 Percent Cut to Its Most Affordable GPT-5.6 Model
  4. [4] AI Price Wars: OpenAI Cuts GPT-5.6 Luna Prices by 80% as Model Competition Shifts Toward Cost
  5. [5] OpenAI Blinks in Face of Chinese Rivals, Drops Pricing of Some Models 80%
  6. [6] OpenAI Cuts GPT-5.6 Pricing Up To 80% As AI Costs Come Under Scrutiny

来源文章

Top 5

THE SIGNAL.

Analysts

认为价格下调表明企业正在抵制不断上升的 AI 账单,不受控制的 token 使用已不再可行。

Jacob Bourne
高级分析师,EMARKETER

认为 headline token 价格下调掩盖了大规模部署 AI 时更大、更不显眼的成本。

Matteo Cellini
首席营销官兼董事会顾问

认为中国的 AI 发展能力已超过西方预期,解释了为何具有成本竞争力的中国模型正在获得市场青睐。

Paul Triolo
DGA-Albright Stonebridge Group

认为美国对 AI 芯片和技术的出口限制无意中加速了中国本土 AI 的竞争力。

George Chen
合伙人,Asia Group
The Crowd

We are committed to pushing the model frontier across cost efficiency, capability, and speed. Starting today, we are reducing prices for GPT-5.6 Luna by 80% and GPT-5.6 Terra by 20%, and offering a faster option for GPT-5.6 Sol in the API. Luna and Terra's lower prices are...

@@OpenAI18447

The AI price war just got serious. DeepSeek V4 Flash dropped at $0.28/M output. OpenAI cut GPT-5.6 Luna by 80% to $1.20/M. Same price tier. Head to head tests. DeepSeek won every round.

@@RoundtableSpace119

ChatGPT-5.6 Luna got 98% cheaper three weeks after it launched. > Input was $1 per million tokens at launch. > Standard is now $0.20. > Cached reads bill at $0.02. Two cents buys a million tokens you have already sent once, which is most of what an agent loop does all day.

@@slash1sol82

OpenAI lowering prices 80%

@u/moxyte834
Broadcast
GPT-5.6 Sol: Better AND cheaper than Fable

GPT-5.6 Sol: Better AND cheaper than Fable

OpenAI Preparing To Drastically Cut Prices, The Beginning Of The End

OpenAI Preparing To Drastically Cut Prices, The Beginning Of The End

GPT-5.6 Is Coming And A Price War Just Started!

GPT-5.6 Is Coming And A Price War Just Started!