专题 · FULL STORY

Aleph Alpha 开源 Kolibri-1 模型

德国 AI 公司 Aleph Alpha 于 10 月 3 日在 Hugging Face 以 Apache 2.0 协议开源英德双语推理型 MoE 模型 Kolibri-1,总参数 78.1B、仅激活 3.46B,并支持超长上下文。模型发布后迅速引发社区关注与讨论,成为欧洲开源模型的最新代表。

2026-10-03 ~ 2026-10-06 · 2 集 · 17 条

第 1 集 · 德国 Aleph Alpha 开源 Kolibri-1:78B 仅激活 3.46B(2026-10-03,14 条)

德国 AI 公司 Aleph Alpha 于 10 月 3 日(德国统一日)在 Hugging Face 开源发布推理型 MoE 模型 Kolibri-1,并迅速登上平台趋势榜。模型采用 Apache 2.0 许可证,定位为欧洲主权可控的开源权重模型:从零开始、全流程在德国完成训练,并非 Qwen 微调;主打德语和英语双语能力,团队完成了数月的预训练与后训练工作。

已确认

  • 规格:总参数 78.1B,每 token 仅激活 3.46B 参数(约 4.4%),上下文长度最高 100 万 tokens
  • 架构细节(据 @TejasKumar 转述):每层含 384 个小型专家,路由器为每个词只激活 6 个专家,相当于每个词只跑约 3.5B 参数
  • 基准表现(据 @TejasKumar):在 AIME 2025 数学竞赛上得分 96.9%,超过所有被测同量级及更大的 MoE 模型(包括每 token 激活参数更多的模型)
  • 发布形式:提供 vLLM 与 safetensors 格式,并附带论文(arXiv);权重可部署在用户自有硬件上。据 @QuixiAI,权重采用 FP8 格式可直接运行,且已有人向开源推理引擎 colibri(39.5k star)提交 feature request 请求支持
  • 模型仓库已包含聊天模板配置,支持 system 提示、reasoning effort 设置与工具调用格式(据 @JiliJeanlouis 转述)
  • 第三方 Tesseracted Labs 已将模型托管上线,用户无需 GPU 或注册即可在浏览器免费试用几天,并支持 Brave Search 联网搜索(据 @FrankNoeBerlin 转述)

尚未确认

  • AIME 96.9% 等基准成绩目前主要来自发布方材料及 @TejasKumar 等转述者,尚待第三方独立复现验证

为什么重要

  • 这是欧洲「主权 AI」路线的代表性开源成果:从训练到发布均在德国完成,为欧洲提供了不依赖美中的可控模型选项
  • 极低的激活参数比例(约 4.4%)意味着推理成本大幅降低,若基准成绩经第三方验证,将在高效推理模型赛道形成有力竞争
  • 第三方免费试用渠道的出现降低了体验门槛,有助于社区快速形成独立评测

第 2 集 · 德国 Aleph Alpha 开源 Kolibri:78B 参数支持百万上下文(2026-10-05,3 条)

德国公司 Aleph Alpha 在 Hugging Face 以 Apache 2.0 协议开源英德双语 MoE 模型 Kolibri。该模型总参数 78.1B,每个 token 仅激活约 3.46B 参数(约 4.4%),并支持最长 100 万 token 的上下文。Kolibri 定位于公共管理、工业等欧洲主权场景,被认为趁势超越了 Mistral,成为欧洲背景开源大模型的新代表。