模型发布
Aleph Alpha 发布 Kolibri-1:面向德英双语的开放权重推理模型
事件时间 1 个独立来源编辑评分 80/100本站发布
先了解这件事
Aleph Alpha 于 10 月 3 日发布 Kolibri-1。该 Apache 2.0 MoE 模型总参数约 78B、每 token 激活约 3.46B,支持工具调用;最大上下文为 1,048,576 token,但官方建议实际服务使用更低上限。
变化是什么
模型权重和模型卡已公开,可用于自托管评估。
对你意味着什么
它提供德英推理部署选择,但较小激活参数量并不消除完整权重的内存需求。
Kolibri-1 面向德语、英语推理及工具辅助任务。模型卡写明总参数 78,103,074,560,每 token 激活 3,457,573,120;发布博客将激活量取整为 3B。
最大上下文为 1,048,576 token,但模型卡建议在服务效率与复杂任务上控制在 262,144 以内,原生长上下文训练长度也是 262,144。能够接受长输入不等于已经证明可以准确利用整份文档。
主检查点采用 FP8,模型卡估计权重内存约 78 GB。最低配置示例包括两张 80 GB A100、两张 H100 SXM5,或单张 H200、B200、B300。服务开销和缓存还需要额外空间;独立 BF16 检查点的要求不同。
建议先用保守上下文上限建立小型德英评估,核对引用、工具参数和实测内存,再决定部署。目录词条提供模型卡入口。事件日期采用官方发布博客的 10 月 3 日,未编造具体时刻。
事实核查
报道时间线
- 一手来源Aleph AlphaKolibri Has Landed: A Sovereign Open-Weight Model
- 一手来源Aleph AlphaKolibri-1 model card