Qwen3.8-Max,通常称为 Qwen3.8-2.4T-A95B,是阿里巴巴于 2026 年 8 月 3 日发布的旗舰大语言模型。它采用带混合注意力的稀疏 MoE 架构,总参数 2.4 万亿(每 token 激活约 950 亿),是史上最大的 Qwen 模型,总参数约为 2025 年 4 月发布的 Qwen3-235B-A22B 的 10 倍。
2026-08-17 复核 阿里云模型列表:Coder Plus 为 $0.14 / $0.80,Qwen3.8-397B-A17B 为 $0.29 / $1.20。引用 2.4T 第三行前先核确切 SKU。
模型规格
| 规格 | Qwen3.8-2.4T-A95B |
|---|---|
| 架构 | 稀疏 MoE + 混合注意力(Qwen3.5 基座) |
| 总参数 | 2.4T |
| 激活参数 | 约 95B |
| 上下文长度 | 1,000,000 token(输入 983,616 / 输出 131,072) |
| 推理预算 | 最高 262,144 个思考 token |
| 输入模态 | 文本、图像、视频、文档 |
| 输出模态 | 文本 |
| API 模型 ID | qwen3.8-max |
核心特点
- 首个开源权重的 Max 级 Qwen:Qwen3.8-Max 是首个承诺开源的 Max 级 Qwen,权重计划于 2026 年 8 月 10 日当周上架 Hugging Face 与 ModelScope(同时承诺配套稠密模型 Qwen3.8-27B)。
- 原生多模态:单一模型内实现文本、图像与视频理解,Vision Arena 榜单排名前二。
- 长程智能体能力:10 天自主编码演示,终端/编码智能体得分强劲。
- 超大上下文:1M token 上下文窗口,26.2 万 token 推理预算。
基准亮点
- PaperBench:93.0,全球第一(Claude Fable 5 为 88.8,GPT-5.6 Sol 为 90.5)
- OSWorld-Verified:86.1,第一(对手分别为 85.0 与 83.2)
- IFBench:82.8,第一(对手分别为 63.5 与 72.7)
- GPQA Diamond:92.6(Fable 5 为 92.6,Sol 为 94.1)
- Terminal-Bench 2.1:86.6(Qwen3.7-Max 为 74.5)
- Text Arena (LMArena):1491±8 Elo,总榜第五
- CodeArena WebDev:1668 Elo,排名第四
定价
| 地区 | 输入(每百万 token) | 输出(每百万 token) |
|---|---|---|
| 国际版(QwenCloud) | $2.00 | $6.00 |
| 中国大陆(DashScope) | ¥12 | ¥36 |
Batch API 按刊例价 5 折计费。按每百万 token $2/$6 计算,Qwen3.8-Max 的价格约为 Claude Fable 5 刊例价(输出 $15/百万 token)的三分之一。思考 token 按输出 token 计费。
注意事项
官方承诺开源权重于 2026 年 8 月 10 日当周发布,但截至 8 月 13 日,Qwen 官方 Hugging Face 组织页面尚未上架。协议尚未披露,此前 Qwen 的发布均采用 Apache 2.0。发布当天阿里巴巴股价上涨 7%。
总结
Qwen3.8-2.4T-A95B 将阿里巴巴推入全球前沿模型的第一梯队,在 PaperBench 与 OSWorld 上排名第一,同时价格低于封闭竞争对手。如果开源承诺兑现,它将成为史上最大的宽松协议开源模型,是开源 AI 社区的一座里程碑。
评论
还没有评论。成为第一个评论的人!
相关工具
Kimi K3
www.kimi.com
月之暗面(Moonshot AI)开源的 2.8T 参数多模态智能体模型,1M token 上下文,全球首个开源 3T 级模型,在编码与智能体基准上逼近封闭前沿模型。
Qwen3.8-27B
qwen.ai
阿里巴巴开源的 27B 稠密模型,Qwen3.8-Max 的配套稠密版本,Apache 2.0 协议,支持图文多模态输入,面向本地部署与小批量推理。
Gemma 4 26B A4B
ai.google.dev/gemma
Google DeepMind 开源权重模型,25.2B 总参数 MoE 架构每 token 仅激活 3.8B,256K 上下文,支持图文多模态输入,Apache 2.0 商用友好协议。
相关洞察

Anthropic Subagent:多智能体时代的架构革命
深入解析 Anthropic 的多智能体架构设计。了解如何通过 Subagent 突破上下文窗口限制,实现性能提升 90%,以及多智能体系统在 Claude Code 中的实际应用。
别再把 AI 助手塞进聊天框了:Clawdbot 选错了战场
Clawdbot 很方便,但将它放在 Slack 或 Discord 里操控,是从一开始就错的设计选择。聊天工具不是用来操作任务的,AI 也不是用来聊天的。
我把 Obsidian 接入 OpenClaw 后,它开始帮我做决策
当 Obsidian 不再只是记笔记,而是接入 OpenClaw 之后,它开始帮我整理信息、连接上下文、推动判断,甚至参与真实决策。