DeepSeek V4 Pro 发布
TECH

DeepSeek V4 Pro 发布

25+
Signals

战略概览

  • 01.
    DeepSeek 于2026年8月12日发布了其旗舰模型 DeepSeek-V4-Pro-0813 的正式生产版本,结束了约四个月的预览期。
  • 02.
    DeepSeek-V4-Pro 是一个混合专家模型(Mixture-of-Experts),总参数量达1.6万亿,每 token 激活490亿参数,支持长达100万 token 的上下文窗口和最高38.4万个 token 的输出。
  • 03.
    V4 Pro 采用混合注意力架构(压缩稀疏注意力 + 高度压缩注意力),在100万 token 上下文设置下,将单 token 推理计算量降至 DeepSeek-V3.2 所需的27%,KV 缓存降至10%。
  • 04.
    DeepSeek V4 Pro 以 MIT 许可证开源权重发布,支持自托管,同时也可以通过 DeepSeek 自家 API 和 OpenRouter 使用。

价格下调背后的架构

本周 DeepSeek 引发关注的不仅是基准分数——更是一项让长上下文推理成本低到近乎免费的架构决策。结合压缩稀疏注意力与高度压缩注意力的混合注意力设计意味着,在100万 token 上下文设置下,V4 Pro 所需的单 token 推理 FLOPs 仅为 DeepSeek-V3.2 的27%,KV 缓存仅为10%[1]。其底层是一个总参数量为1.6万亿的混合专家模型,每个 token 仅激活490亿参数,训练数据超过32万亿 token,并以 MIT 许可证开源权重发布[2]。Greyhound Research 分析师 Sanchit Vir Gogia 认为这是刻意为之的设计选择而非副作用:V4 Pro “专为降低长上下文推理成本而打造,单 token 计算量约为前代的四分之一,内存占用仅为十分之一”[3]。正是这种效率,使得本周通过编码代理测试该模型的开发者报告称,端到端任务的实际成本仅为几美分而非数美元——起作用的是架构本身,而不仅仅是折扣。

AI 定价战升级

V4 Pro 的官方定价——缓存未命中时每百万输入 token 0.435美元,缓存命中时仅0.003625美元,每百万输出 token 0.87美元——是 DeepSeek 在今年早些时候促销后将75%的价格降幅永久化的结果[3]。时机进一步凸显了对比:xAI/SpaceXAI 的 Grok 4.6 正好在同一天发布,定价为每百万输入 token 2美元、每百万输出 token 6美元,约为 V4 Pro 输出价格的七倍[4]。相关报道指出,DeepSeek 的输出定价约为 GPT-5.6 Sol 的三十五分之一,Anthropic 同类产品定价的五十七分之一[3]。Counterpoint Research 的 Neil Shah 认为,DeepSeek 已“在复杂数学与推理等关键任务上有效缩小了性能差距,同时在开放性和推理成本方面激进地引领市场”[3],这正是挤压 OpenAI、Anthropic 和 Google 的钳形攻势:它们不能再依赖能力优势来证明高溢价合理性,必须转而在速度、企业功能或接受更低利润率方面展开竞争。

热捧与质疑:Pro 真的比 Flash 更强吗?

市场反应明显按平台分化。在 X 平台上,最响亮的声音是纯粹的价格性能胜利主义——帖子宣称 V4 Pro 以极低成本超越 Anthropic 的 Opus 级别模型,分销合作伙伴强调其在代理基准测试中相比4月预览版有显著提升,包括 Terminal-Bench 2.1 分数提高了约15.8分[5]。Reddit 上的 DeepSeek 社区态度更温和但也更为分裂。热情支持者指出模型的缓存命中定价构成了无与伦比的护城河,并将基准提升视为 V4 Pro 能以几分钱提供接近前沿智能的证明。但一群强烈质疑的少数派则激烈反驳,认为该模型在编程基准测试上落后于 Kimi K3 Max 和 Opus 5 Medium,远非当前一代最佳。更尖锐的反向观点并非认为 Pro 表现不佳,而是 V4 Flash(与其同期发布)已实现了大部分实用价值,使得 Pro 在更高价格下的边际提升更难被接受。一些用户还指出,该模型在调试任务中的思维链推理运行缓慢且冗长,常见的应对方式是缩短或完全禁用“思考”过程,而不是让模型长时间推理。

企业采用与数据主权风险并存

对企业而言,V4 Pro 成本结构的实际优势是明确的:Ankura Consulting 的 Amit Jaju 指出,“当推理成本大幅下降时,许多此前在规模上不经济的项目变得可行”[3]——这直接指向了 V4 Pro 架构旨在降低开销的长上下文、高容量代理工作负载。但同一份报告也警示了相反的风险:由于 DeepSeek 的托管 API 通过中国境内服务商运行,提交敏感数据的企业面临监管合规性与知识产权泄露的公开疑问,而 MIT 开源许可证只能部分抵消这一风险,因为自托管需要真正的基础设施投入[3]。根据该分析,可能的结果是转向多模型企业战略——像 IT 领域对待多云供应商一样对待大语言模型提供商——而非集中采用本周基准排行榜榜首的单一模型。

历史背景

DeepSeek 首个公开模型系列 DeepSeek Coder 发布,开启了公司的模型发布节奏。
DeepSeek-V3 作为6710亿参数(370亿激活)的 MoE 模型发布,确立了通向 V4 的架构谱系。
DeepSeek-V3.1 引入了带128K上下文窗口的混合思考/非思考单模型架构。
DeepSeek-V3.2 在全面托管发布后成为通用旗舰模型,引入了 DeepSeek 稀疏注意力。
DeepSeek-V4 预览版(含 V4-Pro 和 V4-Flash)上线并开源,开启了100万 token 上下文时代。
DeepSeek 将其促销期间的75% V4-Pro 降价永久化,加剧了 AI 定价战。
DeepSeek 与 xAI/SpaceXAI 的 Grok 4.6 在同一天发布了 V4-Pro-0813 的正式版本。

关键关系图

关键玩家
主题

DeepSeek V4 Pro 发布

DE

DeepSeek (Liang Wenfeng)

开发并推出 V4 Pro 的中国 AI 实验室;设定激进的开源权重定价策略,对现有前沿实验室施加压力,并推动企业成本效益叙事。

XA

xAI / SpaceXAI (Elon Musk)

在 V4 Pro 正式发布的同一天推出 Grok 4.6;在知识工作基准上竞争,但输出 token 定价约为 V4 Pro 的7倍。

OP

OpenAI, Anthropic, Google

面临 DeepSeek 成本结构带来的定价压力的现有前沿实验室;必须通过 DeepSeek 无法匹敌的能力、速度或企业功能来证明其高溢价的合理性。

OP

OpenRouter / DeepInfra / Ollama / Hugging Face

列出 DeepSeek-V4-Pro-0813 供 API 接入和自托管的分发与托管平台,扩大了其在开发者中的影响力。

事实来源

5 条引用
  1. [1] DeepSeek V4 Pro
  2. [2] deepseek-ai/DeepSeek-V4-Pro
  3. [3] DeepSeek's steep V4 Pro price cut escalates AI pricing war
  4. [4] DeepSeek V4 Pro GA rolling out, Grok 4.6 API spotted
  5. [5] DeepSeek V4 Pro Official Version Likely Launched

来源文章

Top 1

THE SIGNAL.

Analysts

V4-Pro was engineered to cut the cost of long-context inference, running at roughly a quarter of the single-token compute and a tenth of the memory footprint of its predecessor.

Sanchit Vir Gogia
Greyhound Research

DeepSeek has effectively closed the performance gap on critical tasks like complex math and reasoning while aggressively leading the market on openness and inference costs.

Neil Shah
Counterpoint Research

Local hosting of DeepSeek models makes previously uneconomical AI projects newly viable because inference costs drop dramatically at scale.

Amit Jaju
Ankura Consulting
The Crowd

DeepSeek V4 Pro 0813 is live on OpenRouter. @deepseek_ai reports large agent gains over V4 Pro Preview: DeepSWE 62.7 (+49.9), CyberGym 83.3 (+30.6), NL2Repo 61.5 (+23.0), and Terminal Bench 2.1 87.9 (+15.8) More providers coming online soon Use it now: https://t.co/1PYoEFbvyK

@@OpenRouter1292

Deepseek V4 Pro DESTROYED Opus 4.8 while being approximately 20 times cheaper Polymarket gives a 3% chance of them becoming the best Chinese AI in August V4 Pro is almost on par with the Kimi K3 and close to the Fable 5 this model can easily handle 95% of tasks basically, https://t.co/U3c5hoqAR8

@@goodworse15

@opencode Grok 4.6 and DeepSeek V4 Pro. What a day! https://t.co/dCcnKjYUlN

@@yangyang_204810

DeepSeek V4 Pro official version has been updated to the API

@u/nekofneko276
Broadcast
UNLIMITED FREE Deepseek-V4 PRO AI Coder: THIS IS CRAZY!

UNLIMITED FREE Deepseek-V4 PRO AI Coder: THIS IS CRAZY!

JUST $1 For Billions of Tokens?! (DeepSeek v4 Pro)

JUST $1 For Billions of Tokens?! (DeepSeek v4 Pro)

I Tried NEW Deepseek V4 Pro/Flash: Price, Speed, Quality Compared

I Tried NEW Deepseek V4 Pro/Flash: Price, Speed, Quality Compared