Qwen3.8-Max,通常称为 Qwen3.8-2.4T-A95B,是阿里巴巴于 2026 年 8 月 3 日发布的旗舰大语言模型。它采用带混合注意力的稀疏 MoE 架构,总参数 2.4 万亿(每 token 激活约 950 亿),是史上最大的 Qwen 模型,总参数约为 2025 年 4 月发布的 Qwen3-235B-A22B 的 10 倍。
模型规格
| 规格 | Qwen3.8-2.4T-A95B |
|---|---|
| 架构 | 稀疏 MoE + 混合注意力(Qwen3.5 基座) |
| 总参数 | 2.4T |
| 激活参数 | 约 95B |
| 上下文长度 | 1,000,000 token(输入 983,616 / 输出 131,072) |
| 推理预算 | 最高 262,144 个思考 token |
| 输入模态 | 文本、图像、视频、文档 |
| 输出模态 | 文本 |
| API 模型 ID | qwen3.8-max |
核心特点
- 首个开源权重的 Max 级 Qwen:Qwen3.8-Max 是首个承诺开源的 Max 级 Qwen,权重计划于 2026 年 8 月 10 日当周上架 Hugging Face 与 ModelScope(同时承诺配套稠密模型 Qwen3.8-27B)。
- 原生多模态:单一模型内实现文本、图像与视频理解,Vision Arena 榜单排名前二。
- 长程智能体能力:10 天自主编码演示,终端/编码智能体得分强劲。
- 超大上下文:1M token 上下文窗口,26.2 万 token 推理预算。
基准亮点
- PaperBench:93.0,全球第一(Claude Fable 5 为 88.8,GPT-5.6 Sol 为 90.5)
- OSWorld-Verified:86.1,第一(对手分别为 85.0 与 83.2)
- IFBench:82.8,第一(对手分别为 63.5 与 72.7)
- GPQA Diamond:92.6(Fable 5 为 92.6,Sol 为 94.1)
- Terminal-Bench 2.1:86.6(Qwen3.7-Max 为 74.5)
- Text Arena (LMArena):1491±8 Elo,总榜第五
- CodeArena WebDev:1668 Elo,排名第四
定价
| 地区 | 输入(每百万 token) | 输出(每百万 token) |
|---|---|---|
| 国际版(QwenCloud) | $2.00 | $6.00 |
| 中国大陆(DashScope) | ¥12 | ¥36 |
Batch API 按刊例价 5 折计费。按每百万 token $2/$6 计算,Qwen3.8-Max 的价格约为 Claude Fable 5 刊例价(输出 $15/百万 token)的三分之一。思考 token 按输出 token 计费。
注意事项
官方承诺开源权重于 2026 年 8 月 10 日当周发布,但截至 8 月 13 日,Qwen 官方 Hugging Face 组织页面尚未上架。协议尚未披露,此前 Qwen 的发布均采用 Apache 2.0。发布当天阿里巴巴股价上涨 7%。
总结
Qwen3.8-2.4T-A95B 将阿里巴巴推入全球前沿模型的第一梯队,在 PaperBench 与 OSWorld 上排名第一,同时价格低于封闭竞争对手。如果开源承诺兑现,它将成为史上最大的宽松协议开源模型,是开源 AI 社区的一座里程碑。
评论
还没有评论。成为第一个评论的人!
相关工具
Kimi K3
www.kimi.com
月之暗面(Moonshot AI)开源的 2.8T 参数多模态智能体模型,1M token 上下文,全球首个开源 3T 级模型,在编码与智能体基准上逼近封闭前沿模型。
DeepSeek V4 Pro 0813
www.deepseek.com
DeepSeek 旗舰 1.6T MoE 模型,激活参数 49B,1M token 上下文,MIT 协议开源权重,LiveCodeBench 编码得分全球第一,定价仅为封闭前沿模型的零头。
Claude Opus 5
www.anthropic.com/claude/opus
Anthropic 前沿 Opus 级模型,1M token 上下文与可调思考强度,以 Opus 4.8 的价格带来接近 Fable 5 的智能水平,适合智能体与长周期编码任务。
相关洞察
我把 Obsidian 接入 OpenClaw 后,它开始帮我做决策
当 Obsidian 不再只是记笔记,而是接入 OpenClaw 之后,它开始帮我整理信息、连接上下文、推动判断,甚至参与真实决策。
别再把 AI 助手塞进聊天框了:Clawdbot 选错了战场
Clawdbot 很方便,但将它放在 Slack 或 Discord 里操控,是从一开始就错的设计选择。聊天工具不是用来操作任务的,AI 也不是用来聊天的。
低代码平台的黄昏:为什么 Claude Agent SDK 会让 Dify 们成为历史
从大模型第一性原理深度剖析为什么 Claude Agent SDK 将取代 Dify。探讨为什么自然语言描述流程比图形化编排更符合人类原始行为模式,以及为什么这是 AI 时代的必然选择。