模型发布

Aleph Alpha 发布 Kolibri-1:面向德英双语的开放权重推理模型

事件时间 1 个独立来源编辑评分 80/100本站发布

先了解这件事

Aleph Alpha 于 10 月 3 日发布 Kolibri-1。该 Apache 2.0 MoE 模型总参数约 78B、每 token 激活约 3.46B,支持工具调用;最大上下文为 1,048,576 token,但官方建议实际服务使用更低上限。

变化是什么

模型权重和模型卡已公开,可用于自托管评估。

对你意味着什么

它提供德英推理部署选择,但较小激活参数量并不消除完整权重的内存需求。

Kolibri-1 面向德语、英语推理及工具辅助任务。模型卡写明总参数 78,103,074,560,每 token 激活 3,457,573,120;发布博客将激活量取整为 3B。

最大上下文为 1,048,576 token,但模型卡建议在服务效率与复杂任务上控制在 262,144 以内,原生长上下文训练长度也是 262,144。能够接受长输入不等于已经证明可以准确利用整份文档。

主检查点采用 FP8,模型卡估计权重内存约 78 GB。最低配置示例包括两张 80 GB A100、两张 H100 SXM5,或单张 H200、B200、B300。服务开销和缓存还需要额外空间;独立 BF16 检查点的要求不同。

建议先用保守上下文上限建立小型德英评估,核对引用、工具参数和实测内存,再决定部署。目录词条提供模型卡入口。事件日期采用官方发布博客的 10 月 3 日,未编造具体时刻。

事实核查

  • 已核实Aleph Alpha 于 2026 年 10 月 3 日发布 Kolibri-1,面向德英推理和工具使用。依据
  • 已核实模型总参数 78,103,074,560,每 token 激活 3,457,573,120,权重采用 Apache 2.0。依据
  • 已核实最大上下文 1,048,576 token;建议上限和原生长上下文训练长度为 262,144。依据
  • 已核实FP8 模型卡估计权重内存 78 GB,最低示例包含两张 80 GB A100、两张 H100 SXM5 或单张 H200/B200/B300;BF16 另行提供。依据

报道时间线

  1. 一手来源Aleph Alpha
    Kolibri Has Landed: A Sovereign Open-Weight Model
  2. 一手来源Aleph Alpha
    Kolibri-1 model card