Qwen3.8-2.4T-A95B logo

Qwen3.8-2.4T-A95B

打开

阿里巴巴旗舰 2.4T MoE 模型,激活参数 95B,1M token 上下文,原生多模态输入,PaperBench 与 OSWorld 全球登顶,史上最大的 Qwen 模型。

分享:

Qwen3.8-Max,通常称为 Qwen3.8-2.4T-A95B,是阿里巴巴于 2026 年 8 月 3 日发布的旗舰大语言模型。它采用带混合注意力的稀疏 MoE 架构,总参数 2.4 万亿(每 token 激活约 950 亿),是史上最大的 Qwen 模型,总参数约为 2025 年 4 月发布的 Qwen3-235B-A22B 的 10 倍。

模型规格

规格 Qwen3.8-2.4T-A95B
架构 稀疏 MoE + 混合注意力(Qwen3.5 基座)
总参数 2.4T
激活参数 约 95B
上下文长度 1,000,000 token(输入 983,616 / 输出 131,072)
推理预算 最高 262,144 个思考 token
输入模态 文本、图像、视频、文档
输出模态 文本
API 模型 ID qwen3.8-max

核心特点

  • 首个开源权重的 Max 级 Qwen:Qwen3.8-Max 是首个承诺开源的 Max 级 Qwen,权重计划于 2026 年 8 月 10 日当周上架 Hugging Face 与 ModelScope(同时承诺配套稠密模型 Qwen3.8-27B)。
  • 原生多模态:单一模型内实现文本、图像与视频理解,Vision Arena 榜单排名前二。
  • 长程智能体能力:10 天自主编码演示,终端/编码智能体得分强劲。
  • 超大上下文:1M token 上下文窗口,26.2 万 token 推理预算。

基准亮点

  • PaperBench:93.0,全球第一(Claude Fable 5 为 88.8,GPT-5.6 Sol 为 90.5)
  • OSWorld-Verified:86.1,第一(对手分别为 85.0 与 83.2)
  • IFBench:82.8,第一(对手分别为 63.5 与 72.7)
  • GPQA Diamond:92.6(Fable 5 为 92.6,Sol 为 94.1)
  • Terminal-Bench 2.1:86.6(Qwen3.7-Max 为 74.5)
  • Text Arena (LMArena):1491±8 Elo,总榜第五
  • CodeArena WebDev:1668 Elo,排名第四

定价

地区 输入(每百万 token) 输出(每百万 token)
国际版(QwenCloud) $2.00 $6.00
中国大陆(DashScope) ¥12 ¥36

Batch API 按刊例价 5 折计费。按每百万 token $2/$6 计算,Qwen3.8-Max 的价格约为 Claude Fable 5 刊例价(输出 $15/百万 token)的三分之一。思考 token 按输出 token 计费。

注意事项

官方承诺开源权重于 2026 年 8 月 10 日当周发布,但截至 8 月 13 日,Qwen 官方 Hugging Face 组织页面尚未上架。协议尚未披露,此前 Qwen 的发布均采用 Apache 2.0。发布当天阿里巴巴股价上涨 7%。

总结

Qwen3.8-2.4T-A95B 将阿里巴巴推入全球前沿模型的第一梯队,在 PaperBench 与 OSWorld 上排名第一,同时价格低于封闭竞争对手。如果开源承诺兑现,它将成为史上最大的宽松协议开源模型,是开源 AI 社区的一座里程碑。

评论

还没有评论。成为第一个评论的人!