MiniMax M3
MiniMax M3 是公司在 2026 年 6 月 1 日发布的旗舰模型。研究博文写它在编程和智能体任务上达到前沿水平,引入带 100 万 token 上下文的 MiniMax Sparse Attention(MSA),并且原生多模态:支持图像和视频输入,还能操作桌面。MiniMax 称它在发布时是该档里唯一的开源权重模型。API 模型表仍把 M3 列成带 1M 上下文的前沿多模态编程模型。可通过 MiniMax Code、Token Plan 和 API 试用。
核心功能
- MSA 与 1M 上下文:MiniMax 称 MSA 比 DSA 或 MoBA 更精确地切分 KV,在 100 万上下文时每 token 算力约为上一代的 1/20,他们的测试里预填充超过 9 倍、解码超过 15 倍。
- 编程:相对 M2,在修 bug、前后端和性能工作上有明显提升,并称在这些切片上接近海外闭源模型。
- 智能体与办公:搜索、Office 套件流程,以及初步可用的金融任务。
- 原生多模态 + 计算机使用:图像和视频输入,外加操作桌面。MiniMax 把这三项称为闭源旗舰已经具备的“必备能力”。
- 产品入口:MiniMax Code、Token Plan 和按量 API。模型介绍页还列出 M2.7 等更新兄弟型号;该页上 M3 仍是 1M 上下文的编程旗舰。
适用场景
- 需要把整仓和工具轨迹放进同一窗口的长程编程智能体。
- 把文档和代码混在一起的办公与搜索智能体。
- bug 在截图或录屏 UI 上的多模态排障。
定价
官方按量(查阅于 2026-08-17),Standard 档并标注永久 5 折:
| 上下文 | 输入 | 输出 | 缓存读取 |
|---|---|---|---|
| M3,输入 ≤ 512k | $0.30 / M tokens | $1.20 / M tokens | $0.06 / M tokens |
| M3,输入 > 512k | $0.60 / M tokens | $2.40 / M tokens | $0.12 / M tokens |
Priority 更高(≤512k 折后 $0.45 / $1.80 / $0.09)。页上划掉的原价是这些数字的两倍。大批量跑之前再核按量表。
快速开始
- 读 M3 博文。
- 从 MiniMax API 模型指南 或 MiniMax Code 调用。
- 除非需要长上下文加价,否则把提示控制在 512k 以内。
- 若要权重,确认当前开源包。发布文里的 “open-weight” 是产品主张;上线前钉住具体修订。
常见问题
M3 就是站内的 M2.1 吗?
不是。MiniMax M2.1 是更早的 230B MoE 编程模型。M3 是 2026 年 6 月的 1M 上下文多模态后继。
1M 上下文和短提示一个价吗?
不是。API 在 512k 输入 token 处分档。
编程上能取代 Claude 或 GPT 吗?
MiniMax 称在部分编程切片上接近海外闭源。用你自己的仓库验证,不要把厂商文案当成评测。
替代方案
- MiniMax M2.1:如果现有栈仍钉在上一版 MiniMax 编程模型。
- GPT-5.6 Sol:OpenAI 的前沿编程与长上下文。
- Claude Opus 5:Anthropic 当前的编程旗舰。
使用技巧
- 打开提示缓存。Standard 表上缓存读取是输入价的五分之一。
- 只在延迟敏感时用 Priority。折后仍比 Standard 高 50%。
- 再看模型介绍页。MiniMax 还在 M3 旁边叠 M2.7 和 highspeed SKU。
总结
当你需要 100 万上下文、编程智能体和多模态输入集中在一个开源向模型里时,应试 M3。从 M3 博文 和当前 API 价表起步,标准化之前先核实权重和兄弟型号。
评论
还没有评论。成为第一个评论的人!
相关工具
MiniMax H3
www.minimax.io/blog/minimax-h3
MiniMax 于 2026 年 7 月 31 日发布的开源向多模态视频模型:文/图/视频/音频输入,768P 或 2K 输出,4–15 秒,原生立体声,按秒计费。
Laguna S 2.1
poolside.ai
Poolside 开源权重编程模型:118B 总参 / 8B 激活 MoE、100 万 token 上下文、原生交错推理、OpenMDW-1.1 协议,专为智能体编程与长程任务打造。
GLM-5.2
z.ai
智谱 2026 年 6 月的 744B MoE 编程模型,1M 上下文、MIT 权重。现行旗舰已是后继的 GLM-5.3。
相关洞察
7 款 AI 编程 CLI 用了半年,我悟出一个道理:模型再强,干活也要有监督
Claude Code、Codex、opencode、pi、omp、DeepSeek Harness 各有性格。半年深度使用后我总结出一套分工矩阵:pi 做最省事的 CR、omp 审复杂 PR、DeepSeek Harness 配 V4 Flash 高频低成本审查、Claude Code 与 Qoder 写代码。模型再强,干活也要有监督,而且最好是独立第三方。
Claudesidian:让 Obsidian 变成 AI 驱动的第二大脑
通过 Claudesidian 这个开源项目,将 Obsidian 笔记系统与 Claude Code 完美结合。内置 PARA 方法、自定义命令、自动化工作流,从想法到实现的完整解决方案。
锁死 Codex 的不是模型,是选择器
你已经为 OpenCode Go、Grok、Z.ai 付过钱了,但 Codex 的 picker 默认只露出 GPT。社区项目 codex-router 做的不是再教一遍安装步骤,而是把已经买过的模型能力接回选择器:密钥不出本机,原生 GPT 也不动。