DeepSeek-V4-Pro-0813 は 2026 年 8 月 12 日にリリースされた、DeepSeek のフラッグシップモデルの公式 GA ビルドです。総パラメータ 1.6 兆(活性化 490 億)の Mixture-of-Experts トランスフォーマーで、DeepSeek API 上でのビルドタグ付きの静かなリリースを通じて一般提供に到達しました。同日に 0813 ビルドが 4 月のプレビューを静かに置き換えています。ウェイトは Hugging Face で MIT ライセンスにより公開されています。
2026-08-17 に api-docs.deepseek.com を再確認: deepseek-v4-pro は 100 万トークン入力 $0.29 / 出力 $1.20 / キャッシュ $0.03。
モデル仕様
| 仕様 | DeepSeek V4 Pro 0813 |
|---|---|
| アーキテクチャ | DeepSeekMoE(Mixture-of-Experts) |
| 総パラメータ | 1.6T |
| 活性化パラメータ | 49B |
| コンテキストウィンドウ | 1,000,000 トークン(最大出力 384K) |
| 事前学習データ | 33T トークン |
| 精度 | FP4(ルーティングエキスパート)+ FP8 混合 |
| モダリティ | テキストのみ |
| 推論モード | Non-Think / Think High / Think Max(リクエストごとに切替可能) |
| ライセンス | MIT(オープンウェイト) |
主な特徴
- 世界トップのコーディング:LiveCodeBench 93.5%(世界 1 位)、Codeforces レーティング 3206。人間の上位 23 名程度の水準です。
- 効率的な 1M コンテキスト:ハイブリッドアテンション(CSA + HCA)により、1M コンテキストで DeepSeek-V3.2 と比較して、単一トークン推論 FLOPs の 27%、KV キャッシュの 10% のみで動作します。
- アーキテクチャの革新:Manifold-Constrained Hyper-Connections(mHC)、Muon オプティマイザ、Multi-Token Prediction を採用。
- 統一された推論モード:Non-Think、Think High、Think Max を単一の API モデル内でリクエストごとに選択可能。
- 幅広い API 互換性:OpenAI ChatCompletions、Anthropic Messages、Responses API に対応。
ベンチマークのハイライト
- SWE-bench Verified:80.6%(V3.2 比 +12.8 ポイント)
- LiveCodeBench:93.5%(世界 1 位)
- Codeforces:3206 Elo
- GPQA Diamond:90.1%
- MMLU-Pro:87.5%
- Terminal-Bench 2.1:87.9(4 月プレビューの 72.1 から上昇)
- HMMT 2026 Feb:95.2%
- LMArena:1456 Elo(2026 年 6 月)
料金
| ティア | キャッシュヒット(入力) | キャッシュミス(入力) | 出力 |
|---|---|---|---|
| deepseek-v4-pro | $0.003625 | $0.435 | $0.87 |
100 万トークンあたり約 $0.65 のブレンドレートで、DeepSeek V4 Pro は Claude Fable 5(100 万トークンあたり $10/$50)より約 46 倍安価でありながら、比較可能な 9 つのエージェントベンチマークの平均で約 5.3% しか劣っていません。DeepSeek は近い将来の値上げを予告しています。
注意点
0813 ビルドはブログ記事や大々的な発表なしに出荷され、料金ページのモデル名が単に -0813 ビルドタグへと変更されました。0813 固有のベンチマークの独立した再現検証は保留中です。8 月 13 日時点で Hugging Face にホストされていたのは、依然として 4 月プレビューのウェイトでした。
まとめ
DeepSeek V4 Pro 0813 は、MIT ライセンスの 1.6T MoE パッケージで、フロンティア級のコーディングとエージェント性能をクローズドモデルのごく一部の価格で提供します。価値、オープンウェイト、長コンテキストのエージェント作業を重視する開発者にとって、市場で最も魅力的なモデルの 1 つであり続けています。
使用シナリオ
- DeepSeek V4 Pro 0813 が自分のワークフローをカバーするか先に確認したい場合。
関連:Claude 3.5 Sonnet、Claude 3 Haiku。分類は models。
コメント
まだコメントがありません。最初のコメントを投稿してください!
関連ツール
関連インサイト
ChatGPT の Codex 枠が足りない?Codex 内で DeepSeek や Grok に切り替える
Codex Router なら、いつもの Codex 作業環境で DeepSeek や Grok などを使える。仕組み、利用枠、ネットワーク条件をやさしく説明する。
7 つの AI コーディング CLI を半年使って悟ったこと:モデルがどんなに強くても、仕事には監督が必要
Claude Code、Codex、opencode、pi、omp、DeepSeek Harness はそれぞれ性格が違う。半年間の深い使用で確立した分業:pi で最速最省のレビュー、omp で複雑な PR レビュー、DeepSeek Harness + V4 Flash で高頻度・低コストなレビュー、Claude Code と Qoder でコーディング。モデルがどんなに強くても、仕事には監督が必要——しかも独立した第三者であるべき。
Codex でどんなモデルも使える:magpie があれば Codex Router はいらない
無料でオープンソースのメニューバーアプリ magpie は、ローカルにゲートウェイを立てて OpenRouter や DeepSeek、さらに ChatGPT・Claude・Cursor・Grok・Copilot のサブスクリプションまで、Codex 本来のモデル選択画面にそのまま並べる。Codex Router は不要になる。