DeepSeek-V4-Pro-0813 は 2026 年 8 月 12 日にリリースされた、DeepSeek のフラッグシップモデルの公式 GA ビルドです。総パラメータ 1.6 兆(活性化 490 億)の Mixture-of-Experts トランスフォーマーで、DeepSeek API 上でのビルドタグ付きの静かなリリースを通じて一般提供に到達しました。同日に 0813 ビルドが 4 月のプレビューを静かに置き換えています。ウェイトは Hugging Face で MIT ライセンスにより公開されています。
モデル仕様
| 仕様 | DeepSeek V4 Pro 0813 |
|---|---|
| アーキテクチャ | DeepSeekMoE(Mixture-of-Experts) |
| 総パラメータ | 1.6T |
| 活性化パラメータ | 49B |
| コンテキストウィンドウ | 1,000,000 トークン(最大出力 384K) |
| 事前学習データ | 33T トークン |
| 精度 | FP4(ルーティングエキスパート)+ FP8 混合 |
| モダリティ | テキストのみ |
| 推論モード | Non-Think / Think High / Think Max(リクエストごとに切替可能) |
| ライセンス | MIT(オープンウェイト) |
主な特徴
- 世界トップのコーディング:LiveCodeBench 93.5%(世界 1 位)、Codeforces レーティング 3206。人間の上位 23 名程度の水準です。
- 効率的な 1M コンテキスト:ハイブリッドアテンション(CSA + HCA)により、1M コンテキストで DeepSeek-V3.2 と比較して、単一トークン推論 FLOPs の 27%、KV キャッシュの 10% のみで動作します。
- アーキテクチャの革新:Manifold-Constrained Hyper-Connections(mHC)、Muon オプティマイザ、Multi-Token Prediction を採用。
- 統一された推論モード:Non-Think、Think High、Think Max を単一の API モデル内でリクエストごとに選択可能。
- 幅広い API 互換性:OpenAI ChatCompletions、Anthropic Messages、Responses API に対応。
ベンチマークのハイライト
- SWE-bench Verified:80.6%(V3.2 比 +12.8 ポイント)
- LiveCodeBench:93.5%(世界 1 位)
- Codeforces:3206 Elo
- GPQA Diamond:90.1%
- MMLU-Pro:87.5%
- Terminal-Bench 2.1:87.9(4 月プレビューの 72.1 から上昇)
- HMMT 2026 Feb:95.2%
- LMArena:1456 Elo(2026 年 6 月)
料金
| ティア | キャッシュヒット(入力) | キャッシュミス(入力) | 出力 |
|---|---|---|---|
| deepseek-v4-pro | $0.003625 | $0.435 | $0.87 |
100 万トークンあたり約 $0.65 のブレンドレートで、DeepSeek V4 Pro は Claude Fable 5(100 万トークンあたり $10/$50)より約 46 倍安価でありながら、比較可能な 9 つのエージェントベンチマークの平均で約 5.3% しか劣っていません。DeepSeek は近い将来の値上げを予告しています。
注意点
0813 ビルドはブログ記事や大々的な発表なしに出荷され、料金ページのモデル名が単に -0813 ビルドタグへと変更されました。0813 固有のベンチマークの独立した再現検証は保留中です。8 月 13 日時点で Hugging Face にホストされていたのは、依然として 4 月プレビューのウェイトでした。
まとめ
DeepSeek V4 Pro 0813 は、MIT ライセンスの 1.6T MoE パッケージで、フロンティア級のコーディングとエージェント性能をクローズドモデルのごく一部の価格で提供します。価値、オープンウェイト、長コンテキストのエージェント作業を重視する開発者にとって、市場で最も魅力的なモデルの 1 つであり続けています。
コメント
まだコメントがありません。最初のコメントを投稿してください!
関連ツール
DeepSeek V4
www.deepseek.com
DeepSeek V4 は、DeepSeek のフラッグシップ AI モデルの次世代版であり、V3 の成功を基盤に、推論能力、マルチモーダル理解、エージェントベースのインタラクションの向上が期待されています。
Claude Opus 5
www.anthropic.com/claude/opus
Anthropic の最上位 Opus モデル。1M トークンのコンテキストと調整可能な思考強度を備え、Opus 4.8 と同じ価格で Fable 5 に迫る性能を発揮。エージェントと長期コーディング向け。
Qwen3.8-2.4T-A95B
qwen.ai
Alibaba のフラッグシップ 2.4T MoE モデル。活性化パラメータ 95B、1M トークンのコンテキスト、ネイティブな多モーダル入力、トップクラスのエージェント性能を備えた史上最大の Qwen。
関連インサイト
Obsidian を OpenClaw に接続したら、意思決定まで手伝い始めた
Obsidian がただのノート置き場ではなく OpenClaw とつながったとき、情報整理、文脈接続、判断材料の整理、そして実際の意思決定支援まで始まった。
AI アシスタントをチャットボックスに押し込むな:Clawdbot は戦場を間違えた
Clawdbot は便利だが、Slack や Discord に入れて操作するのは最初から間違った設計だ。チャットツールはタスク操作のためのものではなく、AI もおしゃべりのためではない。
ローコードプラットフォームの黄昏:なぜClaude Agent SDKがDifyを歴史にするのか
大規模言語モデルの第一原理から、なぜClaude Agent SDKがDifyを置き換えるのかを深く分析。自然言語でプロセスを記述することが人間の原始的な行動パターンにより合致している理由、そしてなぜこれがAI時代の必然的な選択なのかを探る。