Moonshot AI Kimi K3 Launch
TECH

Moonshot AI Kimi K3 Launch

25+
Signals

战略概览

  • 01.
    月之暗面AI于2026年7月16日发布Kimi K3,这是一款拥有100万token上下文窗口的2.8万亿参数混合专家(Mixture-of-Experts)模型,是迄今为止发布的最大开源模型。
  • 02.
    根据月之暗面内部评估,Kimi K3整体排名仅次于Claude Fable 5和GPT-5.6 Sol,在GDPval-AA v2上得分为1687,AA-Briefcase得分为1527,领先于Claude Opus 4.8 Max。
  • 03.
    Kimi K3的定价为每百万非缓存输入token 3美元,每百万输出token 15美元——与Anthropic计划于2026年9月实施的API定价持平,同时声称具备相当甚至更优的基准性能。
  • 04.
    完整模型权重和技术报告预计将在修改版MIT许可证下很快发布,将开源访问扩展至2.8万亿参数的前沿级模型。

为何2.8万亿参数真正改变了开源的数学逻辑

Kimi K3的规模意义不仅在于 headline 数字,更在于其结构性门槛。此前的开源权重前沿模型——如DeepSeek的V4-Pro(1.6万亿参数)、Meta的Llama系列——虽具备能力,但始终比顶级闭源模型低一个层级 [1]。Kimi K3采用混合专家(MoE)架构,总参数达2.8万亿,每次token推理仅激活256个专家中的220亿活跃参数,是首个由月之暗面自身宣称可与GPT-5.6 Sol和Claude Fable 5处于同一基准层级的开源权重发布 [1]

MoE在此处的关键在于推理经济性。尽管总参数高达2.8万亿,K3在推理过程中每个token仅激活220亿参数——其计算足迹大致相当于更小的稠密模型。这意味着运行K3的API成本并不与其 headline 参数数量成正比。每百万输入token 3美元、输出token 15美元的定价,与Anthropic计划于2026年9月对同等能力水平实施的定价一致 [1]。对于评估API供应商的企业买家而言,问题变成了:为何要为更低的能力支付相同价格?这正是月之暗面设下的定价陷阱。

基准问题:竞争市场中的自我报告评估

Kimi K3最引人注目的主张——全球AI智能排名第二、BrowseComp得分为91.2并被月之暗面称为业界领先——均来自其内部评估 [1]。截至发布之日,尚无Artificial Analysis或Chatbot Arena等独立第三方平台验证这些排名 [2]。这并非微不足道的免责声明:2026年的AI基准领域已多次出现自我报告分数与独立评估严重偏离的情况。

市场反应中的紧张关系显而易见。技术AI社区——通过社交媒体上此次发布引发的广泛讨论来判断——对这些主张持谨慎乐观而非全盘接受的态度。AI评论员@AndrewCurran_在追踪发布前泄露细节时,将K3描述为可能对‘美国实验室造成巨大压力’——这是一种条件性表述,而非确认。相反,AICodeKing的实测评测由月之暗面赞助,这并不否定结果,但意味着来自中立方的独立对比测试才是真正的可信度考验。Kimi K3是否真正实现前沿水平对等的故事仍在书写中。

开源权重作为地缘政治工具:中国超越基准的战略

仅将Kimi K3视为产品发布,会忽略更大的战略图景。月之暗面一贯的模式——2025年7月开源Kimi K2,K2.6在2026年中成为OpenRouter上第二常用的LLM [3]——是刻意在全球开发者生态系统中建立对中国AI基础设施的依赖,尤其是在美国出口管制限制中国获取先进芯片的当下。

开源权重策略反转了通常的杠杆。当开发者基于Kimi K3权重构建产品时,他们并非向Anthropic或OpenAI支付API费用,而是部署一个训练和能力源自中国的模型。对于评估AI主权的非美国政府和企业而言,月之暗面的开源权重模型提供了对美国AI供应商商业依赖的替代方案。Anthropic的回应——指责中国AI公司进行‘工业级蒸馏攻击’,即利用美国模型输出训练竞争性中国模型——正反映了这种竞争焦虑 [4]。若指控属实,则意味着Kimi K3的能力部分源自Anthropic和OpenAI自身的专有前沿工作,并由美国企业客户间接资助。

估值飞轮:为何315亿美元估值合理——以及为何存在风险

据报道,月之暗面AI正在其六个月内第三次融资中以315亿美元的投前估值进行募资 [3],较2026年5月的200亿美元估值大幅上升,仅该轮融资即筹集20亿美元。公司年化经常性收入已突破3亿美元 [3]。这里的逻辑是 headline 发布带来的融资杠杆:一个在全球AI能力中可信地排名第二的模型——即使基于自我报告的基准——足以证明此前无法实现的估值倍数。

风险则相反。前沿AI模型开发资本密集度极高,而K3仅代表加速周期中的一个世代。若独立基准证明Kimi K3的能力显著低于其自我报告排名,估值叙事将在月之暗面最需要持续投资者信心以资助下一代时削弱。金融赌注与基准赌注实为同一赌注。

历史背景

月之暗面AI由中国CEO杨植麟创立,作为前沿AI实验室开启其发展轨迹。
Kimi聊天机器人以128,000 token上下文窗口发布,是首个能接受如此大规模上下文的AI模型,确立了月之暗面的长上下文身份。
Kimi K2以修改版MIT许可证开源,总参数达1万亿,确立了K3延续的开源权重发布先例,规模接近其三倍。
Kimi K2.6发布后,到2026年中已成为OpenRouter上第二常用的LLM,显示出在K3发布前已获得大量开发者采用。
月之暗面在由美团领投的融资轮中以200亿美元估值筹集20亿美元,为K3的开发提供了财务基础,并为公司300亿美元的融资定位。
Kimi K3正式发布为2.8万亿参数的MoE模型,超越此前所有开源模型的规模,标志着中国进入前沿AI能力的最顶级梯队。

关键关系图

关键玩家
主题

Moonshot AI Kimi K3 Launch

MO

Moonshot AI

Kimi K3的开发者及本次发布的主要推动者;一家由中国CEO杨植麟于2023年3月创立的AI初创公司,年经常性收入已达3亿美元以上,正以315亿美元估值进行融资。其开源权重策略通过以具竞争力的API定价将前沿级模型权重交到开发者手中,直接挑战美国实验室。

AN

Anthropic

K3直接对标的主要美国竞争对手;Kimi K3明确针对并声称超越Claude Opus 4.8,仅落后于Claude Fable 5。Anthropic此前单独指控中国AI公司进行‘工业级蒸馏攻击’,为竞争增添了地缘政治知识产权维度。

ME

Meituan (Long-Z Investments)

领投月之暗面2026年5月20亿美元融资轮,估值200亿美元,为K3的开发提供了资金基础。作为中国最大食品配送平台,美团的背书表明中国科技行业对月之暗面的信心超越纯AI投资者。

DE

DeepSeek

最接近的中国开源权重竞争对手;Kimi K3的2.8万亿参数超越DeepSeek V4-Pro的1.6万亿,重新定位月之暗面为中国实验室在开源权重前沿参数竞赛中的领先者,并进一步加剧对DeepSeek的竞争压力。

事实来源

4 条引用
  1. [1] Moonshot's Kimi K3 To Be Largest Open Model With 2.8 Trillion Parameters, Has 1M Context Window
  2. [2] Kimi K3 Is Behind Only Fable 5 And GPT 5.6 Sol In Internal Evaluations, Says Moonshot AI
  3. [3] Moonshot AI Seeks $30 Billion Valuation in Third Funding Round in Six Months
  4. [4] China's Moonshot Challenges Anthropic With a Bigger, Cheaper Model

来源文章

Top 5

THE SIGNAL.

Analysts

Kimi K3的发布凸显了中国AI开发者如何迅速缩小与美国竞争对手的技术差距,可能挑战长期以来认为中国前沿模型落后美国同行八到十二个月的假设。

Industry analysts
AI市场观察员,PYMNTS.com

月之暗面AI可能通过Kimi K3声称的整体智能排名第二(仅次于Fable 5和GPT-5.6 Sol)在AI领域投下了一颗重磅炸弹。

OfficeChai editorial team
报道AI产业的科技媒体
The Crowd

Official In benchmarks, Kimi k3 is reportedly just behind GPT-5.6 and Fable 5, but ahead of Opus 4.8. However, in terms of price, it's on par with Sonnet 5. An absolute game changer. Insane!

@@kimmonismus3139

BREAKING: Kimi K3 is now available on the web and APIs! Both K3 Max and K3 Swarm Max options are available to users. Supports up to 1M context tokens. Optimized for coding, 3D gaming, and complex knowledge tasks.

@@testingcatalog673

Kimi K3 launch details are leaking, and it's possible we may even get it today. K2 was an exceptional model. If Moonshot cooks up anything like they did a year ago, this could put a lot of pressure on the US labs.

@@AndrewCurran_406
Broadcast
Opus 5, Kimi K3, GLM 5.3: Nobody's Slowing DOWN!

Opus 5, Kimi K3, GLM 5.3: Nobody's Slowing DOWN!

Kimi K3 Just Leaked and It's Already Beating The Best Models!

Kimi K3 Just Leaked and It's Already Beating The Best Models!

Kimi K3 (Fully Tested): AN OPEN MODEL BEATS FABLE?!

Kimi K3 (Fully Tested): AN OPEN MODEL BEATS FABLE?!

Moonshot AI Kimi K3 Launch — AI 新闻 | Agentic Brew