一项赢得基准测试却压垮自身服务器的前沿突破
Kimi K3于2026年7月16日通过Kimi应用、Kimi Work、Kimi Code和Kimi API上线,发布时间恰逢上海世界人工智能大会前夕,完整开源权重计划于7月27日跟进发布[3]。该模型为2.8万亿参数的专家混合系统——共896个专家,每token激活16个——基于名为Kimi Delta Attention的混合线性注意力设计,支持原生视觉,上下文窗口最高可达100万个token[2]。它立即以1,679分登顶LMArena前端代码竞技场排行榜,略胜Claude Fable 5和GPT-5.6 Sol[4],总体Elo评分为1547,比前代Kimi K2.6提升了732分[1]。
这一胜利随即带来运营代价。发布48小时内,用户需求将月之暗面的GPU算力推至极限,迫使公司暂停新用户订阅,以保障现有用户,并准备将会员分为通用使用和编码两个独立层级[15]。基准测试领先与基础设施准备之间的差距,才是更值得深思的故事:一个刚刚在编码能力上超越美国顶尖模型的实验室,却无法同时服务其胜利所吸引的用户群,这提醒我们,前沿能力与前沿运营能力并非同一成就。



