DeepSeek-V4-Flash-0731 公开测试版发布及其在AI价格战中的角色
TECH

DeepSeek-V4-Flash-0731 公开测试版发布及其在AI价格战中的角色

29+
Signals

战略概览

  • 01.
    2026年7月31日,DeepSeek正式发布了DeepSeek-V4-Flash-0731的公开测试版,取代了此前4月发布的预览版本。
  • 02.
    该模型保持与4月预览版完全相同的架构和参数量(总参数2840亿/激活参数130亿,MoE结构,100万token上下文),所有性能提升均来自改进的后训练流程,而非新架构或预训练。
  • 03.
    模型权重以MIT许可证发布,并托管于Hugging Face,同时提供DSpark推测性解码变体。
  • 04.
    API定价维持在每100万输入token 0.14美元、每100万输出token 0.28美元,并设有深度缓存命中折扣;不过DeepSeek已表示计划未来引入高峰时段计费机制,在北京工作时间每日7小时内费用翻倍。

完全由后训练构建的升级

DeepSeek在V4-Flash-0731上最关键的决策是它没有改动什么:即模型架构。该模型保留了与4月预览版完全相同的2840亿总参数、混合专家设计中的130亿激活参数以及100万token上下文窗口[2]。所有基准测试的提升都来自于更密集的后训练,重点集中在编码、智能体工作流和工具使用上,而非任何新的预训练过程[1]

这些提升幅度之大,看起来仿佛是一个全新的模型类别。Terminal-Bench 2.1从72.1(前代V4-Pro预览版)跃升至82.7,NL2Repo从38.5升至54.2,Cybergym从52.7升至76.7,Toolathlon-Verified从55.9升至70.3[1]。对于那些认为前沿进展必须依赖扩大参数或算力的人来说,这是一个惊人的结果——同样的权重通过不同的再训练方式,大幅缩小了与更大更昂贵系统的差距。

为何维持价格不变才是真正的武器

DeepSeek甚至无需降价就能加剧价格战——它只是保持原价。API定价仍为每百万输入token 0.14美元、每百万输出token 0.28美元,缓存命中折扣使重复上下文输入成本降至约每百万token 0.0028美元,接近98%的折扣[3]。相比Claude Opus 4.8每百万输入5美元、输出25美元的标价,这通常被引用为成本差距达97%至99%[4]

更有趣的比较对象其实是OpenAI,而非Anthropic。即使在OpenAI对GPT-5.6 Luna进行大幅降价之后,DeepSeek的每任务成本仍低约60%,而在Artificial Analysis Intelligence Index上仅落后GPT-5.6 Luna一个点[5]。换句话说,DeepSeek现在以极小部分的成本达到了接近前沿闭源模型通用智能得分的水平。

有一个细节让“史上最便宜”的说法变得复杂:DeepSeek已透露计划未来引入高峰时段计费机制,每天在北京工作时间7小时内将所有计费翻倍[3]。虽然尚未公布生效日期,但这提醒我们当前的 headlines 价格只是一个促销底价,而非永久定价。

排行榜与终端之间的差距

并非所有人都相信基准测试的提升能直接转化为实际编码表现。DeepSeek自身公布的数字是基于其即将推出的专有测试套件在最低努力模式下运行得出的,这意味着通过其他开发者工具测得的结果可能有所不同——独立测试者已明确指出这一点,而非盲目接受官方数据。

这种怀疑也体现在社区的实际测试中:一些开发者报告称,在实际任务中,DeepSeek的真实编码表现明显落后于Claude Opus 4.8和Sonnet,即便发布的基准显示两者几乎持平。争议焦点不在于V4-Flash-0731是否有所提升——显然有,单次发布就在Artificial Analysis Intelligence Index上提升了10个点[5]——而在于当使用不同测试套件、不同提示词或真实生产代码库时,这些提升有多少能够体现出来。

为何这次不像R1那样引发震动

2025年1月DeepSeek的R1发布曾震惊西方AI市场,因为它是一个真正出人意料的低成本推理模型。而V4-Flash-0731则处于不同的环境之中。市场已经花了一年时间消化“中国实验室能以远低于西方的价格推出接近前沿能力”的事实;Moonshot AI的Kimi K3早已在开源权重排行榜上领先DeepSeek,却并未引发类似R1那样的颠覆性影响[6]

这一背景对于正确解读此次发布至关重要。这确实是一次真实可衡量的进步——并且伴随着新资本支持,DeepSeek最近从腾讯和网易等投资者处筹集了约74亿美元,估值达3500亿元人民币,资金将用于员工人数翻倍并进一步推进智能体AI研发[6]。但这是对已有竞争态势的一次渐进式升级,而非一次需要重新定价的新冲击。值得注意的是,此次发布还略微晚于DeepSeek自己设定的7月中旬目标,且未伴随部分人预期的V4-Pro更新一同推出[6]

谁真正需要做出回应

直接压力落在Anthropic和OpenAI身上,但程度不同。OpenAI已率先行动,大幅下调了GPT-5.6 Luna的定价,而DeepSeek的发布仍使其每任务成本低约60%[5]。Anthropic尚未跟进这两项举措;其策略体现在用户群体对比较的看法中:他们认为客户真正付费的是Claude周边的产品——即围绕模型的编码套件和智能体工具,而非原始的每token价格。

Moonshot AI则是“DeepSeek胜出”叙事中的变数:Kimi K3在Artificial Analysis Intelligence Index上仍领先开源权重前沿约7个点,且Moonshot正通过增加Nvidia GPU容量进一步扩展[6]——这提醒人们,DeepSeek是在争夺开源权重领先地位,而非稳坐榜首。

MIT许可证本身也是一种压力释放阀。任何人都可以从Hugging Face拉取权重并自托管,尽管硬件门槛真实存在——全精度需要类似4xGB300节点的配置,而3-bit量化可将其降至约110GB[2]。这对业余爱好者来说遥不可及,但对于资源充足的初创公司或研究实验室而言完全可行,这悄然将部分竞争压力从API定价转移到了谁掌握最佳推理栈上。

历史背景

发布首个公开模型系列DeepSeek Coder。
发布基于强化学习训练的推理模型DeepSeek-R1,因其成本效益震惊西方AI市场。
推出V4预览代(V4-Pro和V4-Flash),为R1震撼发布一年后的首款旗舰产品。
退役旧有的deepseek-chat和deepseek-reasoner API别名及其针对V3/R1的非高峰折扣定价。
发布DeepSeek-V4-Flash-0731作为正式公开测试版,以不变定价取代4月预览版,通过重新后训练实现智能体和编码能力提升。

关键关系图

关键玩家
主题

DeepSeek-V4-Flash-0731 公开测试版发布及其在AI价格战中的角色

事实来源

6 条引用
  1. [1] DeepSeek Upgrades DeepSeek-V4-Flash-0731 With Major Agentic and Coding Gains
  2. [2] DeepSeek-V4-Flash-0731 Model Card
  3. [3] DeepSeek V4-Flash-0731 Pricing Explained
  4. [4] Claude Opus 4.8 vs DeepSeek V4-Flash: API Pricing and Performance Compared
  5. [5] DeepSeek V4 Flash 0731 Scores 50 on the Artificial Analysis Intelligence Index, 10 Points Above Previous DeepSeek V4 Flash
  6. [6] DeepSeek Releases Official V4-Flash Model as China's AI Race Intensifies

来源文章

Top 5

THE SIGNAL.

Analysts

根据他在OpenRouter上的测试认为,该模型相对于更大竞争对手表现出超常性价比,可能是当前最具价值回报的AI选项之一。

Simon Willison
独立AI评论员兼开发者

指出V4-Flash-0731与早期预览版共享相同架构和定价,但在智能与成本的帕累托前沿上占据有利位置,即使在OpenAI大幅降价后仍能与GPT-5.6 Luna保持竞争力。

Artificial Analysis
独立LLM基准测试机构
The Crowd

DeepSeek-V4-Flash Official API is now LIVE in public beta! We've massively upgraded its Agent capabilities—benchmark scores are now far surpassing the V4-Pro-Preview. Check out the massive performance leap below! The official V4-Flash now natively supports the Responses API format and is fully adapted for Codex! Check out the configuration details in our official API docs: https://api-docs.deepseek.com/quick_start/agent_integrations/codex

@@deepseek_ai27042

DeepSeek V4 Flash just tied Gemini 3.6 Flash on the intelligence index. same score. 30x cheaper on output. Google charges $7.50 per million output. DeepSeek charges $0.28. and it's open weights. closed pricing makes no sense anymore

@@shiri_shh2620

The AI price war is ON. > DeepSeek just dropped V4 Flash 0731 (big capability jump, $0.28/M output) > OpenAI cut GPT-5.6 Luna by 80% to $1.20/M (OpenRouter is currently offering 50% off, bringing it to $0.60/M) Same budget tier now, so I ran both through 3 canvas tests: Rubik's cube: DeepSeek nails every rotation. Luna's turns are buggy, stickers fly off mid-move. Fireworks: both fine, but Luna lags hard when the burst explodes. Pen writing "Hello": neither is legible. DeepSeek's cursive is looser, but Luna gave up on animating, it rendered a static image. GPT-5.6 is great at coding — but IMO only on Sol. In the same pricing tier, DeepSeek clearly beats Luna.

@@stevibe1933

DeepSeek V4-Flash is officially out, still dirt cheap. USA don't like that, and want ban open source models.

@u/bi4key1800
Broadcast
DeepSeek V4 Flash Is OUT, OpenAI "mewthree" + GPT-5.6 Price/Speed Update, Qwen 3.8 Kinsley, & More!

DeepSeek V4 Flash Is OUT, OpenAI "mewthree" + GPT-5.6 Price/Speed Update, Qwen 3.8 Kinsley, & More!

Deepseek V4 Flash (0731 - Fully Tested): TOP 5 in my TESTS! This is AN ACTUAL COMEBACK!!!

Deepseek V4 Flash (0731 - Fully Tested): TOP 5 in my TESTS! This is AN ACTUAL COMEBACK!!!

DeepSeek V4 Flash 0731 Just DROP and Is a HUGE Win for Local AI (2 DGX Sparks!)

DeepSeek V4 Flash 0731 Just DROP and Is a HUGE Win for Local AI (2 DGX Sparks!)