Qwen3.8-Max,通常称为 Qwen3.8-2.4T-A95B,是阿里巴巴于 2026 年 8 月 3 日发布的旗舰大语言模型。它采用带混合注意力的稀疏 MoE 架构,总参数 2.4 万亿(每 token 激活约 950 亿),是史上最大的 Qwen 模型,总参数约为 2025 年 4 月发布的 Qwen3-235B-A22B 的 10 倍。
模型规格
| 规格 | Qwen3.8-2.4T-A95B |
|---|---|
| 架构 | 稀疏 MoE + 混合注意力(Qwen3.5 基座) |
| 总参数 | 2.4T |
| 激活参数 | 约 95B |
| 上下文长度 | 1,000,000 token(输入 983,616 / 输出 131,072) |
| 推理预算 | 最高 262,144 个思考 token |
| 输入模态 | 文本、图像、视频、文档 |
| 输出模态 | 文本 |
| API 模型 ID | qwen3.8-max |
核心特点
- 首个开源权重的 Max 级 Qwen:Qwen3.8-Max 是首个承诺开源的 Max 级 Qwen,权重计划于 2026 年 8 月 10 日当周上架 Hugging Face 与 ModelScope(同时承诺配套稠密模型 Qwen3.8-27B)。
- 原生多模态:单一模型内实现文本、图像与视频理解,Vision Arena 榜单排名前二。
- 长程智能体能力:10 天自主编码演示,终端/编码智能体得分强劲。
- 超大上下文:1M token 上下文窗口,26.2 万 token 推理预算。
基准亮点
- PaperBench:93.0,全球第一(Claude Fable 5 为 88.8,GPT-5.6 Sol 为 90.5)
- OSWorld-Verified:86.1,第一(对手分别为 85.0 与 83.2)
- IFBench:82.8,第一(对手分别为 63.5 与 72.7)
- GPQA Diamond:92.6(Fable 5 为 92.6,Sol 为 94.1)
- Terminal-Bench 2.1:86.6(Qwen3.7-Max 为 74.5)
- Text Arena (LMArena):1491±8 Elo,总榜第五
- CodeArena WebDev:1668 Elo,排名第四
定价
| 地区 | 输入(每百万 token) | 输出(每百万 token) |
|---|---|---|
| 国际版(QwenCloud) | $2.00 | $6.00 |
| 中国大陆(DashScope) | ¥12 | ¥36 |
Batch API 按刊例价 5 折计费。按每百万 token $2/$6 计算,Qwen3.8-Max 的价格约为 Claude Fable 5 刊例价(输出 $15/百万 token)的三分之一。思考 token 按输出 token 计费。
注意事项
官方承诺开源权重于 2026 年 8 月 10 日当周发布,但截至 8 月 13 日,Qwen 官方 Hugging Face 组织页面尚未上架。协议尚未披露,此前 Qwen 的发布均采用 Apache 2.0。发布当天阿里巴巴股价上涨 7%。
总结
Qwen3.8-2.4T-A95B 将阿里巴巴推入全球前沿模型的第一梯队,在 PaperBench 与 OSWorld 上排名第一,同时价格低于封闭竞争对手。如果开源承诺兑现,它将成为史上最大的宽松协议开源模型,是开源 AI 社区的一座里程碑。
相关:Claude 3.5 Sonnet、Claude 3 Haiku,分类见 models。
评论
还没有评论。成为第一个评论的人!
相关工具
相关洞察

Anthropic Subagent:多智能体时代的架构革命
深入解析 Anthropic 的多智能体架构设计。了解如何通过 Subagent 突破上下文窗口限制,实现性能提升 90%,以及多智能体系统在 Claude Code 中的实际应用。
别再把 AI 助手塞进聊天框了:Clawdbot 选错了战场
Clawdbot 很方便,但将它放在 Slack 或 Discord 里操控,是从一开始就错的设计选择。聊天工具不是用来操作任务的,AI 也不是用来聊天的。

Grok Bot、Hermes Bot:一个人,终于配上了智囊团和秘书处
Grok Bot 进了 Cursor Pro+,Hermes Bot 能跑在 VPS 上。它们不是更聪明的聊天框。出主意的是智囊团,抓落实的是秘书处,拍板的还是你。