Aleph Alpha 发布开源权重的德英双语大语言模型 Kolibri
TECH

Aleph Alpha 发布开源权重的德英双语大语言模型 Kolibri

28+
Signals

战略概览

  • 01.
    Aleph Alpha 于 2026 年 10 月 3 日发布了 Kolibri,这是一款德英双语混合专家(Mixture-of-Experts)语言模型,总参数量为 781 亿,每 token 激活 34.6 亿参数,完整权重已根据 Apache 2.0 许可证发布在 Hugging Face 上。
  • 02.
    该架构为 50 层 Transformer,每层包含 384 个路由专家加 1 个共享专家,模型维度为 2,560,词汇表大小为 128,000 个 token,权重采用 FP8 精度,原生上下文长度为 262,144 个 token,可通过扩展支持最高达 1,048,576 个 token 的服务。
  • 03.
    训练在德国和芬兰的 768 块 NVIDIA B200 GPU 上进行,涵盖约 20 万亿 token 的预训练、3.44 万亿 token 的中期训练以及约 2,000 亿 token 的长上下文适配,总计算量达 6.4×10^23 FLOPs。
  • 04.
    Kolibri 完全在德国及欧洲法律框架下构建,无任何外国控制,旨在符合《欧盟人工智能法案》《通用人工智能行为准则》和《通用数据保护条例》(GDPR),并采用 Merlin-Arthur 主动拒绝回答的训练方法,使模型在缺乏足够证据时学会拒绝作答。

专为完全运行于欧洲法律边界内而设计

Kolibri 最关键的决策在其处理第一 token 训练数据之前就已确定:它必须在欧洲本土完成训练,并且始终只能在欧洲境内提供服务。Aleph Alpha 使用位于德国和芬兰的 768 块 NVIDIA B200 GPU,在德国及欧洲法律监管下完成了训练,基础设施与最终模型权重均不受外国控制[2]。这并非偶然细节——而是整个模型的核心价值主张。Aleph Alpha 明确指出其目标客户是公共行政、工业和航空航天领域:在这些行业中,谁可以访问模型数据、数据实际存储位置的重要性往往远超基准测试得分[1]。Kolibri 从底层设计即对齐《欧盟人工智能法案》《通用人工智能行为准则》和 GDPR,且模型根本不提供托管 API,所有部署都必须通过 Aleph Alpha 自有的容器实现自托管推理,而非由 Aleph Alpha 控制的云服务端点[1]。上下文窗口从原生的 262,144 个 token 扩展至服务时的 1,048,576 个 token,进一步强化了这一卖点:客户可在自己拥有的基础设施上处理整份监管文件或技术档案[3]。

教会模型说“我不知道”

对于关键任务的政府和工业应用而言,一个自信但错误的回答往往比不回答更糟糕。Aleph Alpha 的应对方案是 Merlin-Arthur 协议,这是一种定制的主动拒绝训练方法,通过交替使用有可见支持证据和故意隐藏证据的训练样例,教会模型识别自身是否缺乏安全作答所需的依据,从而避免猜测[1]。该公司并未依赖通用基准分数,而是用一套特定的“依据性”指标来支撑这一方法:在 AA-Omniscience 测试中非幻觉率为 44.0%,Merlin-Arthur 依据得分为 0.23,RGB 评估结果显示模型在应拒绝时‘保持沉默’的比例达 85.6%,在不应编造时‘绝不虚构’的比例为 87.3%[1]。结合 Kolibri 整体设计来看,这最清晰地表明 Aleph Alpha 的优化目标与大多数开源权重模型不同——不是追求最大能力,而是在受监管部署中将责任风险降至最低,此时拒绝回答比虚构答案更安全。

以德语优先的工程设计及其复杂回报

Kolibri 对德语的侧重远不止训练数据比例。Aleph Alpha 构建了专为德语形态学优化的 UniBPE 分词器,其预训练数据构成约为 62% 英语、22%-24% 德语和 14% 代码,其中德语部分总计约 4.3 万亿 token[1]。这种投入体现在压缩效率上:Aleph Alpha 报告称其德语文本每 token 仅需 4.90 字节,是其内部对比组中的最佳表现[1]。评测者引用的独立测试发现,该分词器编码德国宪法所需的 token 数量比 GPT-5 少约 15%,且 Aleph Alpha 故意修改了标准数据清洗过滤器,确保长德语复合词不会像其他实验室流水线那样被当作‘噪音’剔除。但以德语优先的分词化并未顺利转化为德语榜单上的领先优势:评测者指出,在 Aleph Alpha 自己发布的基准图表中,至少有一款同类开源 MoE 模型在德语评估中得分高于 Kolibri,而这本应是其主场优势所在。其在语言上的架构投入真实且可衡量;但其声称打造出最佳德语大模型的说法,尚缺乏同等强度的证据支持。

一次技术上可信的发布,却被排行榜争议与并购消息蒙上阴影

外界对 Kolibri 的反应明显分裂为两派:主权本身是否就是目的,还是模型仍需在排行榜上胜出才有意义?Trending Topics 支持后者观点,指出 Kolibri 仅与 2024 年春季的开源模型进行了基准对比,并估计其在独立智能指数中落后于至少 20 款当前可用的开源权重模型[5]。最深入的技术讨论来自 Reddit 上的开源 LLM 社区,主流看法认为 Kolibri 处于代际之间——其性能大致相当于约六个月前同级别混合专家模型,但在通识知识方面落后于当前一代开源模型,包括德语任务。该讨论提出了关于注意力窗口设计和长上下文位置选择的具体架构批评,并质疑 Aleph Alpha 是否可通过从现有开源许可分词器进行知识蒸馏,在更低计算成本下达到类似质量,最终结论是公司可能出于数据主权和德国政府资助原因而非技术原因避开了这条路径。然而,Aleph Alpha 自身披露的计划又让这一主权叙事变得复杂:公司与加拿大企业 Cohere 达成‘跨大西洋主权人工智能解决方案’的合作安排,与其 Kolibri 全欧洲定位显得格格不入,德国联邦数字部长已就此合作关系发声[5]。相比之下,社交媒体反应几乎完全呈庆祝态势——选择在德国统一日发布增强了象征意义——独立开发者强调他们能在发布数小时内免费自托管并试用该模型,显示出真正的草根采纳热度,尽管技术社区仍在同步进行基准之争。

历史背景

由 Jonas Andrulis 和 Samuel Weinbach 在德国海德堡创立,是欧洲打造自有大语言模型的重要尝试之一。
推出通过 API 提供服务的多语言多模态大模型 Luminous 系列,建立在公司早期 MAGMA 多模态研究基础之上。
宣布重大战略转向,放弃自研前沿模型,转而聚焦企业平台战略(PhariaAI);Luminous 系列模型随后被弃用。
Kolibri Origin 是一款 306 亿参数的前身模型,已完成预训练但从未公开发布。
发布 Kolibri-1,一款 781 亿参数(34.6 亿激活)的混合专家模型,以 Apache 2.0 许可证在 Hugging Face 上开源权重。

关键关系图

关键玩家
主题

Aleph Alpha 发布开源权重的德英双语大语言模型 Kolibri

AL

Aleph Alpha

德国 AI 公司,开发并发布了 Kolibri;2019 年由 Jonas Andrulis 和 Samuel Weinbach 在海德堡创立

IL

Ilhan Scheer

Aleph Alpha 首席执行官,曾公开表示 Kolibri 是德国 AI 人才实力的证明

KA

Karsten Wildberger (CDU)

德国联邦数字部长,评论过 Aleph Alpha 与 Cohere 的合作事宜

CO

Cohere

加拿大 AI 公司,正与 Aleph Alpha 推进‘跨大西洋主权 AI 解决方案’,引发外界对 Kolibri 纯欧洲主权定位的质疑

HU

Hugging Face

托管开源 Kolibri-1 模型权重的平台

事实来源

6 条引用
  1. [1] Kolibri Has Landed: A Sovereign Open-Weight Model
  2. [2] Aleph Alpha lanza Kolibri, LLM aleman que activa solo 4.4% de sus parametros
  3. [3] Aleph Alpha releases open-weight Kolibri with 1M context
  4. [4] Aleph-Alpha/Kolibri-1 Model Card
  5. [5] Aleph Alpha's Kolibri open-weight release
  6. [6] Aleph Alpha puts Kolibri's full weights on Hugging Face under Apache 2.0

来源文章

Top 5

THE SIGNAL.

Analysts

“Kolibri 的表现与 2024 年春季的开源模型如 Qwen3.6、Nemotron 3 Super 和 Mistral Small 相当,但未与更强更新的模型如 Qwen3.8、GLM-5.3 和 Kimi K3 进行基准对比,据估计在 Intelligence Index 上落后于至少 20 款其他开源权重模型。”

Trending Topics
欧洲科技媒体,对 Kolibri 相较当前开源模型的竞争力持怀疑态度

“将此次发布置于欧盟监管与 AI 创新之间的长期张力背景下,援引欧洲 AI 圈内‘严格监管会削弱大陆创新能力’的观点,以此理解外界对 Aleph Alpha 等主权 EU 项目持怀疑态度的原因。”

osai-index.eu
独立欧洲 AI 新闻分析师
The Crowd

“Small bird, fast wings, Kolibri is here. 78B parameters. 3.46B active. Up to 1M tokens of context. Built in Europe. Now the weights are yours. Run it on your own hardware, under Apache 2.0.”

@@Aleph__Alpha3512

“Today we launched Kolibri. On German National Day. A new LLM aleph-alpha.com/en/kolibri/ from Aleph Alpha available under Apache 2.0. Its been an intense few months across pre and post training to make this real. Look forward to getting adoption and feedback!”

@@MichaelLHofmann1011

“Dear @Aleph__Alpha team - thank you for making Kolibri-1 open. We care deeply about sovereign AI, and launching it on German Unity Day makes today feel especially fitting. As a small gesture of support, we've hosted and made Kolibri-1 free for anyone to try for the next few days.”

@@konarkmodi283

“Aleph-Alpha/Kolibri-1 · Hugging Face - 78B parameters. 3.46B active. Up to 1M tokens of context - Apache 2.0”

@u/Nunki08461
Broadcast
Aleph Alpha's Kolibri Uses 1/20th of Its Brain. Is It Any Good?

Aleph Alpha's Kolibri Uses 1/20th of Its Brain. Is It Any Good?

Is Europe back in Frontier AI? Aleph Alpha launches Kolibri

Is Europe back in Frontier AI? Aleph Alpha launches Kolibri

Kolibri von Aleph Alpha: 78 Milliarden Parameter, 3,5 Milliarden pro Token

Kolibri von Aleph Alpha: 78 Milliarden Parameter, 3,5 Milliarden pro Token