Mistral发布万亿参数Mistral Large 4('Le Chonk')
TECH

Mistral发布万亿参数Mistral Large 4('Le Chonk')

37+
Signals

战略概览

  • 01.
    Mistral AI于2026年10月6日在阿布扎比AI Everything大会上发布了Mistral Large 4(ML4),该模型被昵称为“le Chonk”,由CEO Arthur Mensch发布。
  • 02.
    ML4是一个原生多模态的混合专家模型,总参数量达1万亿,激活参数为490亿。
  • 03.
    该模型在Mistral位于欧洲的数据中心,使用约3800至4000块Nvidia Grace Blackwell GPU从零开始训练,耗时约两个月。
  • 04.
    Mistral表示,在经过安全审查和红队测试后,完整权重将于2026年10月底前发布,多家媒体指出具体目标日期为10月27日。

以极小部分的算力实现万亿参数

Mistral在自家欧洲数据中心使用约3800至4000块Nvidia Grace Blackwell GPU,耗时约两个月从头训练了ML4[1]。科学副总裁Pierre Stock将此描述为一种刻意追求效率的策略,称其计算量比中国竞争对手“少两到三倍”,也“显著低于”西方闭源实验室[2]。这一说法至关重要,因为它正是Mistral的核心卖点:与其在原始算力上与OpenAI或Google比拼烧钱,该公司更相信通过架构和训练技术,可以用更少的GPU预算缩小差距。这也同时构成了一种主权主张——完全在欧洲境内、使用Mistral自主控制的硬件进行训练,而不依赖外国超大规模云服务商。然而,“算力更少、效果相当”这一说法能否在完整权重发布后经得起独立基准测试的检验,仍是该公司信誉所系的关键问题。

官方基准测试与实测结果的差异

Mistral公布的数字相当亮眼:在Cybench的40项安全竞赛任务中得分为93%,在漏洞复现与修复测试中得分为82%[1]。但在Artificial Analysis的独立智能指数中,ML4得分为38分——虽是目前中国以外最强的开源模型,但仍比GLM-5.3、Kimi K3和MiMo-V2.6-Pro等中国顶尖开源模型低6至8分[3]。实测结果进一步加剧了这种分歧:一位YouTube评测者发现该模型在代理式3D构建任务中表现不稳定,在隐形眼镜模拟和计数任务中得分为0/10,尽管在其他方面表现出色;一位声称已实测的Reddit用户报告称,该模型在国际象棋基准测试中“表现极差”,水平接近2024年11月发布的Mistral Large 2。这些结果并未直接否定Mistral的官方数据,但提醒我们厂商的基准测试与特定工作负载下的实际表现可能存在显著差异。

主权主张与定价现实的碰撞

Mistral将ML4宣传为“在欧洲锻造,为AI主权而生”[1]——端到端部署于欧洲法律框架下,训练涵盖160多种语言,包括所有欧盟官方语言。商业策略也支持这一主张:Mistral的API定价低于OpenAI和Google最新旗舰模型的底价,Constellation Research分析师Larry Dignan指出,Mistral以30亿欧元的D轮融资迅速打造出一个万亿参数模型,执行力非同寻常[5]。但这一主权叙事正遭到其目标社区的质疑:r/europe和r/LocalLLaMA上的评论者指出,目前预览版仅限云端使用,尚未开放代码或权重,质疑在承诺的开源权重真正发布前,一个无法自托管的模型是否真能称为“主权AI”。

一项双刃剑式安全基准

ML4最突出的数据是其网络安全得分——在Cybench的40项安全竞赛任务中得分为93%,在漏洞复现与修复基准测试中得分为82%[1]。这恰恰也是Mistral不立即发布权重的原因:Pierre Stock表示,公司将“与可信合作伙伴和政府合作,确保开源权重可用于防御,而非用于恶意攻击”[2],暗示在全面开源前将进行审查。这种双重用途的紧张关系并非假设——一位YouTube实测者发现,该模型能独立发现样本应用中的真实IDOR漏洞、明文密码和硬编码会话密钥。一个如此擅长发现漏洞的模型,同样具备利用这些漏洞的能力,这正是Mistral声称在权重全面公开前试图管理的风险。

欧洲的“第三条道路”在纸面上仍落后于中国

Mistral的发布呼应了法国总统埃马纽埃尔·马克龙关于AI需要一条区别于中美之外的欧洲“第三条道路”的说法[4],公司也迅速强化了这一叙事——从2023年成立并发布首个7B开源模型,到如今推出万亿参数模型,仅用了约三年时间,而30亿欧元的D轮融资也恰好在ML4发布前几周完成[6]。然而,在开源权重竞赛最关键的指标上,ML4虽是“中国以外最强的开源模型”,但在Artificial Analysis的智能指数上仍落后于GLM-5.3、Kimi K3和MiMo-V2.6-Pro等中国顶尖模型数个百分点[3]。欧洲如今拥有了一个可信的开源权重竞争者,但中国实验室引领开源前沿的地缘政治格局并未因此次发布而改变。

历史背景

由Arthur Mensch、Guillaume Lample和Timothée Lacroix共同创立。
Mistral首个开源权重模型发布。
与Le Chat一同推出的旗舰闭源Mistral Large系列,同时获得微软1600万美元战略投资。
Mistral此前最大的公开模型,一个6750亿参数(410亿激活参数)的混合专家模型。
Mistral披露了一轮30亿欧元的D轮融资,投后估值超过210亿欧元,投资方包括Nvidia、ASML和Salesforce Ventures。
在阿布扎比AI Everything大会上宣布ML4('le Chonk')进入公开预览,计划在月底前发布完整权重。

关键关系图

关键玩家
主题

Mistral发布万亿参数Mistral Large 4('Le Chonk')

MI

Mistral AI

法国AI实验室及Mistral Large 4的开发者,由Arthur Mensch、Guillaume Lample和Timothée Lacroix于2023年4月创立。

AR

Arthur Mensch

Mistral AI首席执行官兼联合创始人,在阿布扎比AI Everything大会上介绍了ML4。

PI

Pierre Stock

Mistral科学副总裁,描述了模型的计算效率以及在开放权重前对合作伙伴进行审查的计划。

GU

Guillaume Lample

Mistral联合创始人,将ML4定位为开源权重模型的前沿。

NV

Nvidia

提供了用于训练的Grace Blackwell GPU,同时也是Mistral 30亿欧元D轮融资的投资方之一。

中国

中国开源实验室(DeepSeek、Moonshot AI、Zhipu/GLM)

作为ML4的基准竞争对手,被Mistral称为‘中国以外最强的开源模型’,但其中多个模型在独立指数上仍领先于ML4。

事实来源

6 条引用
  1. [1] Mistral Large 4
  2. [2] Mistral's new 1T model aims to leapfrog closed and open rivals
  3. [3] Mistral debuts Large 4 ('Le Chonk'), a 1 trillion parameter text-output model with high benchmarks, planned for open-weights release
  4. [4] Mistral AI launches Large 4 preview ahead of open-weight release
  5. [5] Mistral makes its open model case: Mistral Large 4
  6. [6] Mistral AI

来源文章

Top 5

THE SIGNAL.

Analysts

“认为ML4处于开源权重模型的前沿,引用其在盲测人类编码评估中排名第五中的第二位,仅次于Claude Opus 5。”

Guillaume Lample
Mistral AI联合创始人

“将此次训练视为相对于竞争对手计算效率的证明,并描述了在开源权重发布前对合作伙伴和政府进行审查的流程。”

Pierre Stock
Mistral AI科学副总裁

“鉴于其160种语言的训练背景,认为ML4是一个可信的企业级和主权AI选择,并赞扬Mistral在30亿欧元D轮融资后的执行速度。”

Larry Dignan
Constellation Research分析师
The Crowd

“Meet Mistral Large 4, aka Le Chonk. • 1T parameters, natively multimodal. 49B active. It is the best open weights model from US or Europe on aggregated benchmarks. • State-of-the-art on critical workloads, including cyber defense, manufacturing and finance and it surpasses”

@@MistralAI39621

“Mistral just shipped Large 4, its biggest model ever. So I gave the same 3D prompt to 8 models. One shot, no fixes. Open: Mistral Large 4, Kimi K3, GLM 5.3, DeepSeek V4 Pro Closed: Claude Opus 5.5, Sonnet 5.5, GPT-6 Astra, GPT-6.1 Sol Results below”

@@domsilvestre144

“Mistral Large 4 just lost to DeepSeek V4.1 Flash on the same prompt. Europe's flagship model couldn't beat a Chinese flash model.”

@@RoundtableSpace44

“Introducing Mistral Large 4”

@u/pc09991100
Broadcast
Mistral Large 4 aka "le Chonk": Europe's Biggest Open Model

Mistral Large 4 aka "le Chonk": Europe's Biggest Open Model

Le chonk: The Mistral Large 4 Thoroughly Tested

Le chonk: The Mistral Large 4 Thoroughly Tested

Mistral Large 4 (Le Chonk - Fully Tested): Is IT ACTUALLY The BEST OPEN MODEL!?

Mistral Large 4 (Le Chonk - Fully Tested): Is IT ACTUALLY The BEST OPEN MODEL!?