Qwen3.8-Max(一般に Qwen3.8-2.4T-A95B と呼ばれる)は、2026 年 8 月 3 日にリリースされた Alibaba のフラッグシップ大規模言語モデルです。総パラメータ 2.4 兆(トークンあたり活性化約 950 億)のスパース MoE アーキテクチャにハイブリッドアテンションを組み合わせており、史上最大の Qwen モデルとなっています。2025 年 4 月にリリースされた Qwen3-235B-A22B の約 10 倍の総パラメータです。
モデル仕様
| 仕様 | Qwen3.8-2.4T-A95B |
|---|---|
| アーキテクチャ | スパース MoE + ハイブリッドアテンション(Qwen3.5 基盤) |
| 総パラメータ | 2.4T |
| 活性化パラメータ | 約 95B |
| コンテキストウィンドウ | 1,000,000 トークン(入力 983,616 / 出力 131,072) |
| 推論バジェット | 最大 262,144 思考トークン |
| 入力モダリティ | テキスト、画像、動画、文書 |
| 出力モダリティ | テキスト |
| API モデル ID | qwen3.8-max |
主な特徴
- 初のオープンウェイト Max クラス Qwen:Qwen3.8-Max はオープンソース化が約束された初の Max クラス Qwen で、2026 年 8 月 10 日の週に Hugging Face と ModelScope でウェイトが公開予定です(コンパニオンのデンスモデル Qwen3.8-27B も約束されています)。
- ネイティブ多モーダル:テキスト・画像・動画理解を単一モデルで実現し、Vision Arena リーダーボードでトップ 2 にランクイン。
- 長期間のエージェント能力:10 日間の自律コーディングデモと、強力なターミナル・コーディングエージェントスコア。
- 大容量コンテキスト:1M トークンのコンテキストウィンドウと 262K トークンの推論バジェット。
ベンチマークのハイライト
- PaperBench:93.0。世界 1 位(Claude Fable 5 の 88.8、GPT-5.6 Sol の 90.5 に対し)
- OSWorld-Verified:86.1。1 位(85.0 と 83.2 に対し)
- IFBench:82.8。1 位(63.5 と 72.7 に対し)
- GPQA Diamond:92.6(Fable 5 の 92.6、Sol の 94.1 に対し)
- Terminal-Bench 2.1:86.6(Qwen3.7-Max の 74.5 から上昇)
- Text Arena (LMArena):1491±8 Elo、総合 5 位
- CodeArena WebDev:1668 Elo、4 位
料金
| リージョン | 入力(100 万トークンあたり) | 出力(100 万トークンあたり) |
|---|---|---|
| 国際(QwenCloud) | $2.00 | $6.00 |
| 中国本土(DashScope) | ¥12 | ¥36 |
Batch API の利用は定価の 50% です。100 万トークンあたり $2/$6 で、Qwen3.8-Max は Claude Fable 5 の定価(出力 $15/M)の約 3 分の 1 です。思考トークンは出力トークンとしてカウントされます。
注意点
オープンウェイトは 2026 年 8 月 10 日の週に約束されましたが、8 月 13 日時点で Qwen 公式 Hugging Face 組織ページにはまだ登場していません。ライセンスは未開示ですが、過去の Qwen リリースは Apache 2.0 で出荷されています。リリース当日に Alibaba の株価は 7% 上昇しました。
まとめ
Qwen3.8-2.4T-A95B は Alibaba を世界のフロンティアモデルの最上位層へと押し上げ、PaperBench と OSWorld で 1 位を獲得しながら、クローズド競合を価格で下回っています。オープンウェイトの約束が果たされれば、これまでにリリースされた最大の寛容ライセンスモデルとなり、オープンソース AI コミュニティにとってのマイルストーンとなるでしょう。
コメント
まだコメントがありません。最初のコメントを投稿してください!
関連ツール
Kimi K3
www.kimi.com
Moonshot AI のオープンウェイト 2.8T パラメータ多モーダルエージェントモデル。1M トークンのコンテキストを備えた世界初のオープン 3T 級モデルで、コーディングとエージェントのベンチマークでクローズド最先端に迫る。
DeepSeek V4 Pro 0813
www.deepseek.com
DeepSeek のフラッグシップ 1.6T MoE モデル。活性化パラメータ 49B、1M トークンのコンテキスト、MIT ライセンスのオープンウェイトを備え、世界トップのコーディングスコアをクローズドモデルのごく一部の価格で実現。
Claude Opus 5
www.anthropic.com/claude/opus
Anthropic の最上位 Opus モデル。1M トークンのコンテキストと調整可能な思考強度を備え、Opus 4.8 と同じ価格で Fable 5 に迫る性能を発揮。エージェントと長期コーディング向け。
関連インサイト
Obsidian を OpenClaw に接続したら、意思決定まで手伝い始めた
Obsidian がただのノート置き場ではなく OpenClaw とつながったとき、情報整理、文脈接続、判断材料の整理、そして実際の意思決定支援まで始まった。
AI アシスタントをチャットボックスに押し込むな:Clawdbot は戦場を間違えた
Clawdbot は便利だが、Slack や Discord に入れて操作するのは最初から間違った設計だ。チャットツールはタスク操作のためのものではなく、AI もおしゃべりのためではない。
ローコードプラットフォームの黄昏:なぜClaude Agent SDKがDifyを歴史にするのか
大規模言語モデルの第一原理から、なぜClaude Agent SDKがDifyを置き換えるのかを深く分析。自然言語でプロセスを記述することが人間の原始的な行動パターンにより合致している理由、そしてなぜこれがAI時代の必然的な選択なのかを探る。