MiniMax M3 logo

MiniMax M3

打开

MiniMax 2026 年 6 月 1 日的开源向旗舰模型:MSA 架构、100 万 token 上下文、原生图像/视频输入与桌面计算机使用,API 现价有折扣。

分享:

MiniMax M3

MiniMax M3 是公司在 2026 年 6 月 1 日发布的旗舰模型。研究博文写它在编程和智能体任务上达到前沿水平,引入带 100 万 token 上下文的 MiniMax Sparse Attention(MSA),并且原生多模态:支持图像和视频输入,还能操作桌面。MiniMax 称它在发布时是该档里唯一的开源权重模型。API 模型表仍把 M3 列成带 1M 上下文的前沿多模态编程模型。可通过 MiniMax Code、Token Plan 和 API 试用。

核心功能

  • MSA 与 1M 上下文:MiniMax 称 MSA 比 DSA 或 MoBA 更精确地切分 KV,在 100 万上下文时每 token 算力约为上一代的 1/20,他们的测试里预填充超过 9 倍、解码超过 15 倍。
  • 编程:相对 M2,在修 bug、前后端和性能工作上有明显提升,并称在这些切片上接近海外闭源模型。
  • 智能体与办公:搜索、Office 套件流程,以及初步可用的金融任务。
  • 原生多模态 + 计算机使用:图像和视频输入,外加操作桌面。MiniMax 把这三项称为闭源旗舰已经具备的“必备能力”。
  • 产品入口:MiniMax Code、Token Plan 和按量 API。模型介绍页还列出 M2.7 等更新兄弟型号;该页上 M3 仍是 1M 上下文的编程旗舰。

适用场景

  • 需要把整仓和工具轨迹放进同一窗口的长程编程智能体
  • 把文档和代码混在一起的办公与搜索智能体
  • bug 在截图或录屏 UI 上的多模态排障

定价

官方按量(查阅于 2026-08-17),Standard 档并标注永久 5 折:

上下文 输入 输出 缓存读取
M3,输入 ≤ 512k $0.30 / M tokens $1.20 / M tokens $0.06 / M tokens
M3,输入 > 512k $0.60 / M tokens $2.40 / M tokens $0.12 / M tokens

Priority 更高(≤512k 折后 $0.45 / $1.80 / $0.09)。页上划掉的原价是这些数字的两倍。大批量跑之前再核按量表。

快速开始

  1. M3 博文
  2. MiniMax API 模型指南 或 MiniMax Code 调用。
  3. 除非需要长上下文加价,否则把提示控制在 512k 以内。
  4. 若要权重,确认当前开源包。发布文里的 “open-weight” 是产品主张;上线前钉住具体修订。

常见问题

M3 就是站内的 M2.1 吗?

不是。MiniMax M2.1 是更早的 230B MoE 编程模型。M3 是 2026 年 6 月的 1M 上下文多模态后继。

1M 上下文和短提示一个价吗?

不是。API 在 512k 输入 token 处分档。

编程上能取代 Claude 或 GPT 吗?

MiniMax 称在部分编程切片上接近海外闭源。用你自己的仓库验证,不要把厂商文案当成评测。

替代方案

使用技巧

  1. 打开提示缓存。Standard 表上缓存读取是输入价的五分之一。
  2. 只在延迟敏感时用 Priority。折后仍比 Standard 高 50%。
  3. 再看模型介绍页。MiniMax 还在 M3 旁边叠 M2.7 和 highspeed SKU。

总结

当你需要 100 万上下文、编程智能体和多模态输入集中在一个开源向模型里时,应试 M3。从 M3 博文 和当前 API 价表起步,标准化之前先核实权重和兄弟型号。

评论

还没有评论。成为第一个评论的人!