2026 年 8 月 13 日,DeepSeek 发布新模型 deepseek-v4-pro(版本号 0813,即发布日期)。核心事实:1M 上下文、最大输出 384K、默认思考模式,官方 API 输入定价 $0.435/百万 token、输出 $0.87/百万 token,缓存命中的输入仅 $0.003625/百万 token;官方同步预告「近期将大幅上调 DeepSeek API 服务整体定价」。模型已通过 OpenRouter 上线,同一时间 Qwen 放出 3.8 系列开源权重,两家发布日撞期。
发布了什么
- 版本号 0813 是发布日期而非次版本号:DeepSeek-V4-Pro-0813,与 7 月 31 日的 DeepSeek-V4-Flash-0731 命名同规则。
- 发布渠道极简:没有官方博客页,信息源为官方 API 文档、微信公众号发布和 OpenRouter 模型页。HN 讨论帖(785 分、300+ 评论)里多位用户找不到可引用的官方链接,这是该模型的发布形态本身的特点,不是遗漏。
- 时间线撞期:8 月 12 日 Qwen 在 Hugging Face / ModelScope 放出 Qwen3.8-2.4T-A95B 权重(2.4T 总参数、95B 激活)。HN 社区把两天内的密集发布解读为「同台对打」(出处见文末 HN 讨论),官方未对此表态。

核心参数
官方 API 定价页(2026-08-13 核验)对比:
| 项目 | deepseek-v4-pro(0813) | deepseek-v4-flash(0731) |
|---|---|---|
| 上下文长度 | 1M | 1M |
| 最大输出 | 384K | 384K |
| 思考模式 | 支持思考/非思考,默认思考 | 同左 |
| 输入价格(缓存命中) | $0.003625 / 1M token | $0.0028 / 1M token |
| 输入价格(缓存未命中) | $0.435 / 1M token | $0.14 / 1M token |
| 输出价格 | $0.87 / 1M token | $0.28 / 1M token |
| 并发上限 | 500 | 2500 |
| 功能 | JSON 输出、工具调用、Responses API、Anthropic API、前缀补全(Beta,仅非思考)、FIM 续写(Beta,仅非思考) | 同左 |
对照参考:V4 Pro 的输出价是 Flash 的 3.1 倍,未命中缓存输入价是 Flash 的 3.1 倍。官方参数页未列视觉输入能力,社区确认该模型不支持图像输入。
官方预告涨价
定价页原文(英文):「We plan to raise the overall pricing for DeepSeek API services in the near future, with a significant increase expected.」——近期将上调整体定价,且预计幅度显著,具体方案以官方通知为准。

这条预告对两种用法影响不同:
- 缓存命中为主的工作负载(Agent 循环里系统提示、历史上下文反复读取):命中价只有 $0.003625,即使涨价数倍仍可能是同级模型里最便宜的选择。
- 长上下文首次输入(缓存未命中 $0.435):这部分对涨价最敏感,应在调价后重新核算。
社区按 Agent 编码典型比例做过一次测算(750 输入 / 290 输出 / 82K 缓存读取,来源见文末):单请求约 $0.000875,而同任务口径的 Opus 侧约 $0.052,差约 60 倍。这是社区估算,不是官方口径——官方从未发布跨模型对比定价,引用时请以自己账单为准。
性能:社区整理的对比表(待官方核实)
官方没有发布可核验的基准页面,以下数据来自 HN 讨论中用户转述的官方微信基准表与社区汇总,逐项标注来源属性:
与 Fable 5 的逐项对比(社区转述,来源见文末 scrlk 评论):
| 基准 | DS-V4-Pro 0813 | Fable 5(含 fallback) |
|---|---|---|
| HLE(带工具) | 60.0 | 63.0 |
| Terminal Bench 2.1 | 87.9 | 88.0 |
| Cybergym | 83.3 | 83.1 |
| DeepSWE | 62.7 | 70.0 |
| Toolathlon-Verified | 74.1 | 77.9 |
| AutomationBench(Public) | 31.8 | 29.1 |
| DSBench-FullStack | 71.1 | 77.2 |
| DSBench-Hard | 67.2 | 68.3 |
社区按几何均值排序(goldenarm 评论):GPT-5.6 Sol 65.5、Fable 5 64.5、Opus 5 64.0、DS-V4-Pro 0813 62.5、Kimi-K3 62.3、DS-V4-Flash 55.8、GLM-5.2 47.3。按这个口径,V4 Pro 0813 处于第一梯队末尾:没有单项登顶,但和前三名的均值差距在 2-3 分以内。
社区实测的口径分裂值得注意:有人在 Codex CLI 上做了单次同任务对比(DeepSeek 12 分钟 $0.12 有 bug;Grok 4.6 三分半 $1.41 无 bug),也有人反馈「编码一般,但研究/评估/行动类任务能和最贵模型打平」。单次对比样本不构成结论,HN 讨论里也明确指出了这一点。
为什么值得关注
- 价格带断层:如果社区转述的基准均值成立,V4 Pro 0813 是与第一梯队均值差 2-3 分、但输入输出单价低一个数量级的选项。官方未发对比定价,这个「差距」需自行验证。
- 接入成本为零:官方同时提供 OpenAI 格式和 Anthropic 格式 API(Base URL
https://api.deepseek.com/anthropic),Claude Code、Codex CLI 等工具改环境变量即可直连,不需要迁移工具链。 - 迭代节奏信号:Qwen3.8-Max(8 月 3 日)→ V4 Flash 0731(7 月底更新)→ V4 Pro 0813 + Qwen3.8-2.4T 权重(8 月 12-13 日)。国产模型从「追 SOTA」转向「同一天发新旗舰和开源权重」的节奏,对 API 消费者是明确的价格下行信号,对做模型选型的团队则是更频繁的评估成本。
待核验的部分
- 基准数据:无官方基准页面,上表全部为社区转述。核验方式:关注 DeepSeek 官方微信公众号发布原文、或等官方基准页上线后对照。
- 涨价幅度与时间:官方只说「近期、显著」,未给数字。当前定价随时可能变,本文章的价格信息以 2026-08-13 核验为准。
- 隐私与数据:OpenRouter 端该模型目前要求开启「允许付费端点使用请求数据训练」;DeepSeek 隐私政策允许将提示词与输出用于训练。有合规要求的团队需评估,这是社区讨论中的主要顾虑点。
- 并发上限:500 并发对单团队够用,对大规模 Agent 调度需评估隔离策略。
自己接入验证
官方 Anthropic 格式接入(Claude Code / Codex 通用):
export ANTHROPIC_MODEL="deepseek-v4-pro"
export ANTHROPIC_SMALL_FAST_MODEL="deepseek-v4-pro"
export ANTHROPIC_BASE_URL="https://api.deepseek.com/anthropic"
export ANTHROPIC_AUTH_TOKEN="你的DeepSeek API Key"
OpenAI 格式一行验证:
curl https://api.deepseek.com/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $DEEPSEEK_API_KEY" \
-d '{"model":"deepseek-v4-pro","messages":[{"role":"user","content":"用一句话总结 Rust 所有权规则"}],"max_tokens":200}'
跑通后自己复测一遍上面的性能对比表里你最关心的 1-2 个基准(社区口径 vs 实际体感差距可能很大),把结果记下来——这正是本文「待核验」部分想让你补上的数据。
FAQ
DeepSeek V4 Pro 0813 什么时候发布的? 2026 年 8 月 13 日。版本号 0813 即发布日期,与 V4 Flash 0731 的命名规则一致。
DeepSeek V4 Pro 0813 多少钱? 官方定价(2026-08-13 核验):输入 $0.435/百万 token(缓存命中 $0.003625)、输出 $0.87/百万 token。官方预告近期将大幅上调。
DeepSeek V4 Pro 0813 支持视觉输入吗? 不支持。官方参数页未列视觉能力,社区确认仅文本输入。
DeepSeek V4 Pro 0813 能直接接入 Claude Code 吗? 能。官方提供 Anthropic 格式 API(Base URL 为 https://api.deepseek.com/anthropic ),设置 ANTHROPIC_BASE_URL、ANTHROPIC_MODEL、ANTHROPIC_AUTH_TOKEN 三个环境变量即可。
你站哪一派
这轮发布的争议点可以归成三派,你的选择是:
- A. 价格派:同档性能里单价低一个数量级,先接进来把用量迁过去,涨价前锁定成本结构。
- B. 执行层派:规划、设计交给第一梯队旗舰,V4 Pro 只做执行层,接受它需要更详细的计划。
- C. 观望派:官方基准页和涨价方案出来之前不换,现有栈跑得好好的就不动。
评论区说出你的选择和理由。尤其欢迎真的在 production 里跑过 V4 Pro 或 V4 Flash 的读者——你的一条真实账单数据(模型 / 任务 / 成本 / 结果),比两边的十段论点都值钱。
如果你拿不准,今晚就把上面的接入代码跑一遍,用同一个任务对比你现在的模型,把两组结果(成本 / 耗时 / 结果质量)贴在评论区。下周我们把读者的实测结果整理成一篇续篇。
觉得这篇文章对你的团队有用,转发给那个正在纠结「国产模型能不能进生产环境」的同事。
相关阅读
- Qwen3.8-Max 发布:2.4T 参数编程实测、下周开源,AI 编程格局要变? (2026-08-03,梦兽编程)
- DeepSeek突发大招:V3.2-Exp稀疏注意力机制登场,API价格再砍一半 (梦兽编程)
- 七问 Kimi K3:中国大模型离「好用」还有多远? (梦兽编程)
资料来源
- DeepSeek API 官方文档「Models & Pricing」页,2026-08-13 核验:https://api-docs.deepseek.com/quick_start/pricing/(参数表、定价、涨价预告原文)
- DeepSeek API 官方文档,Anthropic API 接入说明:https://api-docs.deepseek.com/(Anthropic API 章节)
- OpenRouter 模型页 deepseek/deepseek-v4-pro-0813,2026-08-12 上线:https://openrouter.ai/deepseek/deepseek-v4-pro-0813
- Hacker News 讨论帖「DeepSeek V4 Pro 0813」,2026-08-12 提交,785 分:https://news.ycombinator.com/item?id=49274600(社区基准表、价格测算、实测反馈、隐私讨论均出自该帖,引用时已标注评论者)
- Qwen 官方 Hugging Face 权重页 Qwen3.8-2.4T-A95B,2026-08-12 放出:https://huggingface.co/Qwen/Qwen3.8-2.4T-A95B
本文价格与参数信息核验时间:2026-08-13。官方已预告调价,发布前请对照定价页复核。
