MiniMax M3
MiniMax M3 は、同社が 2026 年 6 月 1 日に出したフラッグシップです。研究ポストは、コーディングとエージェント作業でフロンティア水準に達し、100 万トークン文脈の MiniMax Sparse Attention(MSA)を導入し、画像・動画入力とデスクトップ操作まで含むネイティブマルチモーダルだと書いています。発表時点でそのクラス唯一のオープンウェイトだとも主張しています。API のモデル表は今も M3 を 1M 文脈のフロンティア・マルチモーダルコーディングモデルとして載せています。MiniMax Code、Token Plan、API から試せます。
主な機能
- MSA と 1M 文脈:MiniMax は MSA が DSA や MoBA より精密に KV を分割し、100 万文脈でのトークンあたり計算が前世代の約 1/20、自社テストでは prefilling 9 倍超、decoding 15 倍超だとする。
- コーディング:M2 よりバグ修正、フロント/バック、性能作業で大きく伸び、それらのスライスでは海外クローズドに近づいたと主張。
- エージェントとオフィス:検索、Office 系ワークフロー、初期的な金融タスク。
- ネイティブマルチモーダル + コンピュータ利用:画像と動画の入力に加え、デスクトップを操作する。MiniMax はこれをクローズド旗艦がすでに持っていた第三の必須能力と呼ぶ。
- プロダクト面:MiniMax Code、Token Plan、従量 API。モデル紹介には M2.7 など新しい兄弟も並ぶ。そのページでは M3 が 1M 文脈のコーディング旗艦のまま。
使いどころ
- リポジトリ全体とツール軌跡を一つの窓に載せたい長時間コーディングエージェント。
- 文書とコードを混ぜるオフィス/検索エージェント。
- バグがスクリーンショットや録画 UI にあるマルチモーダルデバッグ。
料金
公式従量(2026-08-17 確認)。Standard に永久 50% オフ表示:
| 文脈 | 入力 | 出力 | キャッシュ読み |
|---|---|---|---|
| M3、入力 ≤ 512k | $0.30 / M tokens | $1.20 / M tokens | $0.06 / M tokens |
| M3、入力 > 512k | $0.60 / M tokens | $2.40 / M tokens | $0.12 / M tokens |
Priority は高い(≤512k で割引後 $0.45 / $1.80 / $0.09)。ページ上の取り消し線の定価はその倍です。大規模実行の前に従量表を再確認してください。
はじめ方
- M3 の記事 を読む。
- MiniMax API モデルガイド または MiniMax Code から呼ぶ。
- 長文脈の加算が要らないなら、プロンプトを 512k 以下に保つ。
- 重みが欲しいなら現行パッケージを確認する。発表文の open-weight は製品主張です。出荷前に特定リビジョンをピンする。
よくある質問
このサイトの M2.1 と同じですか?
違います。MiniMax M2.1 は以前の 230B MoE コーディングモデルです。M3 は 2026 年 6 月の 1M 文脈マルチモーダル後継です。
1M 文脈は短いプロンプトと同じ料金ですか?
いいえ。API は入力 512k トークンで価格を分けます。
コーディングで Claude や GPT を置き換えられますか?
MiniMax は一部のコーディングスライスで海外クローズドに近づいたとしています。自前のリポジトリで検証し、ベンダーコピーをベイクオフだと思わないでください。
代替案
- MiniMax M2.1:スタックがまだ前の MiniMax コーディングモデルに固定されている場合。
- GPT-5.6 Sol:OpenAI のフロンティアコーディングと長文脈。
- Claude Opus 5:Anthropic の現行コーディング旗艦。
ヒント
- プロンプトキャッシュを入れる。Standard 表ではキャッシュ読みは入力の 5 分の 1。
- レイテンシが重要なときだけ Priority。割引後でも Standard より 50% 高い。
- モデル紹介を再確認する。MiniMax は M3 の横に M2.7 と highspeed SKU を積み増している。
まとめ
100 万文脈、コーディングエージェント、マルチモーダル入力を一つのオープンウェイト級モデルにまとめたいなら、M3 を試してください。M3 の記事 と現行 API 料金表から始め、標準化する前に重みと兄弟モデルを確認します。
コメント
まだコメントがありません。最初のコメントを投稿してください!
関連ツール
MiniMax H3
www.minimax.io/blog/minimax-h3
MiniMax が 2026 年 7 月 31 日に出したオープン寄りのマルチモーダル動画モデル。テキスト/画像/動画/音声入力、768P または 2K、4–15 秒、ネイティブステレオ、従量 API。
Laguna S 2.1
poolside.ai
Poolsideのオープンウェイト118B MoEコーディングモデル。8Bアクティブ、100万トークンコンテキスト、ネイティブ推論、OpenMDW-1.1ライセンスでエージェントコーディング向け。
GLM-5.2
z.ai
Zhipu が 2026 年 6 月に出した 744B MoE コーディングモデル。1M 文脈と MIT ウェイト。後継の GLM-5.3 が現行フラッグシップ。
関連インサイト
7 つの AI コーディング CLI を半年使って悟ったこと:モデルがどんなに強くても、仕事には監督が必要
Claude Code、Codex、opencode、pi、omp、DeepSeek Harness はそれぞれ性格が違う。半年間の深い使用で確立した分業:pi で最速最省のレビュー、omp で複雑な PR レビュー、DeepSeek Harness + V4 Flash で高頻度・低コストなレビュー、Claude Code と Qoder でコーディング。モデルがどんなに強くても、仕事には監督が必要——しかも独立した第三者であるべき。
Claude Skills 完全ガイド - 必須10大 Skills 徹底解説
Claude Skills の拡張メカニズムを深掘りし、10の中核スキルと Obsidian 連携を詳しく解説。高効率な AI ワークフロー構築を支援します
Codex を閉じ込めているのはモデルではなく、ピッカーだ
OpenCode Go、Grok、Z.ai にはすでに課金しているのに、Codex のピッカーはほぼ GPT しか出さない。コミュニティ製の codex-router が教えるのは手順ではない。すでに買ったモデル能力をセレクタに戻すこと。鍵はマシンから出ず、ネイティブ GPT もそのまま残る。