Qwen 4
Qwen 4 是阿里下一代旗舰模型。在 2026 年杭州云栖大会上,阿里云确认 Qwen 4 目前仍在训练中,并公布了路线图:Qwen 4.5 与 Qwen 5 系列预计将扩展到 5 万亿至 10 万亿参数。目前它什么都没有发布:没有开放权重、没有 API 端点、没有价格表。请把本页所有内容当作公司的路线图表述,而不是今天就能依赖的技术规格。
如果你需要一个立刻可用的 Qwen 模型,Qwen3.8-Max 是当前的开源权重旗舰,Qwen3.8-Flash-Next 则是指向这一代方向的稀疏架构预览。
官方已经确认的信息
| 项目 | 内容 |
|---|---|
| 发布时间 | 2026 年 9 月 22 日,云栖大会(杭州) |
| 当前状态 | 训练中 |
| 路线图 | Qwen 4.5 与 Qwen 5 预计达到 5 万亿至 10 万亿参数 |
| 权重、API、定价 | 均未公布 |
| 架构 | 未披露;预计延续 Qwen3.8-Flash-Next 预览的稀疏混合专家方向 |
| 配套芯片 | 平头哥 Zhenwu V900,216 GB 显存、1,200 GB/s 片间带宽 |
| 基础设施目标 | 到 2032 年阿里云数据中心容量超过 20 GW |
核心看点
- 明确给出了规模目标,而不是规格表:阿里是第一家公开为未来两代模型给出 5 万亿至 10 万亿参数上限的主要厂商。参数量本身说明不了质量,但这个数字反映了公司愿意投入多少训练算力。
- 把"递归自我改进"写进了叙事:阿里称一次超过一个月的全自动运行让 Qwen3.8-Max 完成了 33 轮迭代,覆盖流程设计、数据校验与错误诊断,Artificial Analysis 分数从 40 提升到 45。在另一个芯片设计实验里,模型连续运行 60 多小时、调用 EDA 工具超过 1 万次,把一个生产级芯片总线模块的面积缩减了 42%。
- 围绕它的多模态家族:同一场主题演讲还发布了用于同声传译的 Qwen3.8-LiveTranslate、用于影视级音频生成的 Qwen-Audio-3.1-TTS-Next,以及面向设计与电商营销的 Qwen-Image 3.1。
- 把智能体当作一等目标:Qwen Intelligence 把模型打包成面向手机厂商的智能体平台,用于跨应用任务;阿里也在为这条路线配套建设专用智能体云。
谁应该关注
- 模型观察者:这是中国厂商打算在万亿参数级别竞争、而不只打效率牌的最清晰公开信号。
- 今天就在用 Qwen 的团队:路线图告诉你 4.x 系列的方向,但在权重落地前,容量规划仍应围绕 Qwen3.8-Max。
- 正在比较前沿模型的人:GPT-6 Astra 与 Claude Opus 5.5 已经上线、有第三方评测、有明确价格,Qwen 4 三项都不具备。
可用性与定价
阿里尚未公布 Qwen 4 的发布日期、上下文长度、模态与定价。唯一可参考的是历史规律:此前的 Qwen 旗舰通常先通过 QwenCloud 与百炼平台提供 API,旗舰档随后开放权重。不要据此做预算。
常见问题
今天能用到 Qwen 4 吗?
不能,它还在训练中。生产环境请使用 Qwen3.8-Max 或 Qwen3.8-Flash-Next。
Qwen 4 会开源权重吗?
未公布。阿里近期旗舰档确实开放过权重,但没有对 Qwen 4 做出承诺。
"5 万亿到 10 万亿参数"指的是谁?
这是阿里对 Qwen 4.5 与 Qwen 5 系列的路线图表述,不针对 Qwen 4 本身,且是目标值而非实测结果。
替代方案
如果你现在就需要前沿能力,可以对比 GPT-6 Astra、Claude Opus 5.5、Grok 4.7 与 Kimi K3。需要立刻可用的开放权重,则看 Qwen3.8-Max 与 MiMo-V2.6。
说句实话:Qwen 4 目前只是一个路线图新闻。可以持续跟进云栖大会的发布,但不必为一个还没跑完训练的模型规划迁移。
评论
还没有评论。成为第一个评论的人!
相关工具
Month Visit1000DR: 80AS: 80
Month Visit1000DR: 80AS: 80
Month Visit100DR: 100AS: 100