DeepSeek V3
DeepSeek V3 是上一代 2024 年 12 月 DeepSeek 通用快照,不是现在的 DeepSeek 旗舰。2026-08-18 复核:旧文仍把 671B / 37B 激活 MoE 写成与 GPT-4o 和 Claude 3.5 Sonnet 相当。本站当前 DeepSeek 路径是 DeepSeek V4 Flash($0.14/$0.28)和 DeepSeek V4 Pro。api-docs.deepseek.com 列出的是 deepseek-v4-flash / deepseek-v4-pro。旧的 超越 Qwen2.5-72B 和 Llama-3.1-405B / 与 GPT-4o 相当当 2026 普查 不再沿用。
如果要更早的聊天加编程快照,对比 leftover DeepSeek V2.5;如果要 leftover 推理孪生,对比 leftover DeepSeek-R1;如果要活旗舰,对比 DeepSeek V4 Pro。
核心功能
- 上一代 671B MoE 快照:旧文写过 37B 激活和 14.8T 训练 token。写成活数字前先核一手卡。
- 不是 2026 DeepSeek 主推:活 API 行是 V4 Flash 和 V4 Pro。
- 旧文说还不支持多模态:不要给本 slug 编造 2026 多模态王冠。
- 不编造闭源对等:GPT-4o / Claude 3.5 Sonnet 旧基准不进表。
适用场景
- 还拿着 DeepSeek V3 书签、需要改目录的人。
- 对比 leftover V2.5、leftover V3 与活 V4 的人。
- 差点把 GPT-4o 对等贴进 2026 材料的人。
局限:这次没有重跑 MMLU / LongBench,也没有编造 2026 V3 美元行。
定价方案
一手页,2026-08-18。
| 部分 | 价格 | 说明 |
|---|---|---|
| DeepSeek V3 | 上一代快照 | 核 leftover 托管 / Hugging Face。 |
| 活 DeepSeek 路径 | 核 V4 Flash / V4 Pro | Flash $0.14/$0.28;Pro 是本站活旗舰。 |
如果旧博客还把 V3 写成当前开源 DeepSeek 旗舰,以本页为更正。
快速开始
- 只为确认活 ID 时打开 api-docs.deepseek.com。
- 买 2026 席前先核 DeepSeek V4 Flash 和 DeepSeek V4 Pro。
- 如果要 leftover 推理孪生,再核 leftover DeepSeek-R1。
- 不要把“与 GPT-4o 相当”贴进 2026 材料。
常见问题
V3 还是 DeepSeek 旗舰吗?
不是。本站活路径是 V4 Flash 和 V4 Pro。
和 DeepSeek-R1 一样吗?
不一样。DeepSeek-R1 是 leftover 推理孪生。
它作为 2026 普查超过了 Llama-3.1-405B 吗?
那条旧基准不进表。
替代方案
- DeepSeek V4 Flash:活的小 DeepSeek 智能体模型。
- DeepSeek V4 Pro:活 DeepSeek 旗舰。
- DeepSeek-R1:leftover 2025 推理快照。
使用技巧
- 把 V3 写成 2024 年 12 月快照。
- 新 DeepSeek 工作指向 V4 Flash / V4 Pro。
- 编造 V3 token 价前先核 API 页。
总结
DeepSeek V3 是 leftover 2024 通用快照,不是 2026 DeepSeek 旗舰,也不是 GPT-4o 普查。从 DeepSeek V4 Flash 或 DeepSeek V4 Pro 起步,再决定本页是否只是历史书签。
评论
还没有评论。成为第一个评论的人!
相关工具
DeepSeek V4 Flash
www.deepseek.com
DeepSeek 官方小型智能体模型:284B 总参 / 13B 激活 MoE 架构、1M token 上下文、MIT 开源权重、DSpark 投机解码,每 1M token 仅 $0.14/$0.28。
DeepSeek V4
www.deepseek.com
DeepSeek V4 代表着 DeepSeek 旗舰 AI 模型的下一代产品,在 V3 成功的基础上,预计将在推理能力、多模态理解和智能体交互方面实现重大突破。
DeepSeek V2.5
www.deepseek.com
上一代 DeepSeek V2.5 快照。复核:活路径已经是 V4 Flash/Pro。不是 2026 聊天加编程默认。
相关洞察
7 款 AI 编程 CLI 用了半年,我悟出一个道理:模型再强,干活也要有监督
Claude Code、Codex、opencode、pi、omp、DeepSeek Harness 各有性格。半年深度使用后我总结出一套分工矩阵:pi 做最省事的 CR、omp 审复杂 PR、DeepSeek Harness 配 V4 Flash 高频低成本审查、Claude Code 与 Qoder 写代码。模型再强,干活也要有监督,而且最好是独立第三方。
Windows 上把 OpenCode Go 接进 Codex,别再新开一套工具
ChatGPT 登录的 Codex 桌面版,默认选择器几乎只露出 GPT。Windows 上只开 OpenCode Go 这一家,就能把已经付过钱的 Grok、GLM、Kimi、DeepSeek、MiniMax 接回同一个 picker。密钥不出本机,原生 GPT 也不动。