2026 年 8 月 13 日,DeepSeek 发布新模型 deepseek-v4-pro(版本号 0813,即发布日期)。核心事实:1M 上下文、最大输出 384K、默认思考模式,官方 API 输入定价 $0.435/百万 token、输出 $0.87/百万 token,缓存命中的输入仅 $0.003625/百万 token;官方同步预告「近期将大幅上调 DeepSeek API 服务整体定价」。模型已通过 OpenRouter 上线,同一时间 Qwen 放出 3.8 系列开源权重,两家发布日撞期。

发布了什么

  • 版本号 0813 是发布日期而非次版本号:DeepSeek-V4-Pro-0813,与 7 月 31 日的 DeepSeek-V4-Flash-0731 命名同规则。
  • 发布渠道极简:没有官方博客页,信息源为官方 API 文档、微信公众号发布和 OpenRouter 模型页。HN 讨论帖(785 分、300+ 评论)里多位用户找不到可引用的官方链接,这是该模型的发布形态本身的特点,不是遗漏。
  • 时间线撞期:8 月 12 日 Qwen 在 Hugging Face / ModelScope 放出 Qwen3.8-2.4T-A95B 权重(2.4T 总参数、95B 激活)。HN 社区把两天内的密集发布解读为「同台对打」(出处见文末 HN 讨论),官方未对此表态。

同日双发:DeepSeek 与 Qwen 的火箭并排升空

核心参数

官方 API 定价页(2026-08-13 核验)对比:

项目deepseek-v4-pro(0813)deepseek-v4-flash(0731)
上下文长度1M1M
最大输出384K384K
思考模式支持思考/非思考,默认思考同左
输入价格(缓存命中)$0.003625 / 1M token$0.0028 / 1M token
输入价格(缓存未命中)$0.435 / 1M token$0.14 / 1M token
输出价格$0.87 / 1M token$0.28 / 1M token
并发上限5002500
功能JSON 输出、工具调用、Responses API、Anthropic API、前缀补全(Beta,仅非思考)、FIM 续写(Beta,仅非思考)同左

对照参考:V4 Pro 的输出价是 Flash 的 3.1 倍,未命中缓存输入价是 Flash 的 3.1 倍。官方参数页未列视觉输入能力,社区确认该模型不支持图像输入。

官方预告涨价

定价页原文(英文):「We plan to raise the overall pricing for DeepSeek API services in the near future, with a significant increase expected.」——近期将上调整体定价,且预计幅度显著,具体方案以官方通知为准。

定价一览:缓存命中 $0.003625 / 未命中 $0.435 / 输出 $0.87,顶部红条为官方涨价预告

这条预告对两种用法影响不同:

  • 缓存命中为主的工作负载(Agent 循环里系统提示、历史上下文反复读取):命中价只有 $0.003625,即使涨价数倍仍可能是同级模型里最便宜的选择。
  • 长上下文首次输入(缓存未命中 $0.435):这部分对涨价最敏感,应在调价后重新核算。

社区按 Agent 编码典型比例做过一次测算(750 输入 / 290 输出 / 82K 缓存读取,来源见文末):单请求约 $0.000875,而同任务口径的 Opus 侧约 $0.052,差约 60 倍。这是社区估算,不是官方口径——官方从未发布跨模型对比定价,引用时请以自己账单为准。

性能:社区整理的对比表(待官方核实)

官方没有发布可核验的基准页面,以下数据来自 HN 讨论中用户转述的官方微信基准表与社区汇总,逐项标注来源属性:

与 Fable 5 的逐项对比(社区转述,来源见文末 scrlk 评论):

基准DS-V4-Pro 0813Fable 5(含 fallback)
HLE(带工具)60.063.0
Terminal Bench 2.187.988.0
Cybergym83.383.1
DeepSWE62.770.0
Toolathlon-Verified74.177.9
AutomationBench(Public)31.829.1
DSBench-FullStack71.177.2
DSBench-Hard67.268.3

社区按几何均值排序(goldenarm 评论):GPT-5.6 Sol 65.5、Fable 5 64.5、Opus 5 64.0、DS-V4-Pro 0813 62.5、Kimi-K3 62.3、DS-V4-Flash 55.8、GLM-5.2 47.3。按这个口径,V4 Pro 0813 处于第一梯队末尾:没有单项登顶,但和前三名的均值差距在 2-3 分以内。

社区实测的口径分裂值得注意:有人在 Codex CLI 上做了单次同任务对比(DeepSeek 12 分钟 $0.12 有 bug;Grok 4.6 三分半 $1.41 无 bug),也有人反馈「编码一般,但研究/评估/行动类任务能和最贵模型打平」。单次对比样本不构成结论,HN 讨论里也明确指出了这一点。

为什么值得关注

  1. 价格带断层:如果社区转述的基准均值成立,V4 Pro 0813 是与第一梯队均值差 2-3 分、但输入输出单价低一个数量级的选项。官方未发对比定价,这个「差距」需自行验证。
  2. 接入成本为零:官方同时提供 OpenAI 格式和 Anthropic 格式 API(Base URL https://api.deepseek.com/anthropic),Claude Code、Codex CLI 等工具改环境变量即可直连,不需要迁移工具链。
  3. 迭代节奏信号:Qwen3.8-Max(8 月 3 日)→ V4 Flash 0731(7 月底更新)→ V4 Pro 0813 + Qwen3.8-2.4T 权重(8 月 12-13 日)。国产模型从「追 SOTA」转向「同一天发新旗舰和开源权重」的节奏,对 API 消费者是明确的价格下行信号,对做模型选型的团队则是更频繁的评估成本。

待核验的部分

  • 基准数据:无官方基准页面,上表全部为社区转述。核验方式:关注 DeepSeek 官方微信公众号发布原文、或等官方基准页上线后对照。
  • 涨价幅度与时间:官方只说「近期、显著」,未给数字。当前定价随时可能变,本文章的价格信息以 2026-08-13 核验为准。
  • 隐私与数据:OpenRouter 端该模型目前要求开启「允许付费端点使用请求数据训练」;DeepSeek 隐私政策允许将提示词与输出用于训练。有合规要求的团队需评估,这是社区讨论中的主要顾虑点。
  • 并发上限:500 并发对单团队够用,对大规模 Agent 调度需评估隔离策略。

自己接入验证

官方 Anthropic 格式接入(Claude Code / Codex 通用):

export ANTHROPIC_MODEL="deepseek-v4-pro"
export ANTHROPIC_SMALL_FAST_MODEL="deepseek-v4-pro"
export ANTHROPIC_BASE_URL="https://api.deepseek.com/anthropic"
export ANTHROPIC_AUTH_TOKEN="你的DeepSeek API Key"

OpenAI 格式一行验证:

curl https://api.deepseek.com/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $DEEPSEEK_API_KEY" \
  -d '{"model":"deepseek-v4-pro","messages":[{"role":"user","content":"用一句话总结 Rust 所有权规则"}],"max_tokens":200}'

跑通后自己复测一遍上面的性能对比表里你最关心的 1-2 个基准(社区口径 vs 实际体感差距可能很大),把结果记下来——这正是本文「待核验」部分想让你补上的数据。

FAQ

DeepSeek V4 Pro 0813 什么时候发布的? 2026 年 8 月 13 日。版本号 0813 即发布日期,与 V4 Flash 0731 的命名规则一致。

DeepSeek V4 Pro 0813 多少钱? 官方定价(2026-08-13 核验):输入 $0.435/百万 token(缓存命中 $0.003625)、输出 $0.87/百万 token。官方预告近期将大幅上调。

DeepSeek V4 Pro 0813 支持视觉输入吗? 不支持。官方参数页未列视觉能力,社区确认仅文本输入。

DeepSeek V4 Pro 0813 能直接接入 Claude Code 吗? 能。官方提供 Anthropic 格式 API(Base URL 为 https://api.deepseek.com/anthropic ),设置 ANTHROPIC_BASE_URL、ANTHROPIC_MODEL、ANTHROPIC_AUTH_TOKEN 三个环境变量即可。

你站哪一派

这轮发布的争议点可以归成三派,你的选择是:

  • A. 价格派:同档性能里单价低一个数量级,先接进来把用量迁过去,涨价前锁定成本结构。
  • B. 执行层派:规划、设计交给第一梯队旗舰,V4 Pro 只做执行层,接受它需要更详细的计划。
  • C. 观望派:官方基准页和涨价方案出来之前不换,现有栈跑得好好的就不动。

评论区说出你的选择和理由。尤其欢迎真的在 production 里跑过 V4 Pro 或 V4 Flash 的读者——你的一条真实账单数据(模型 / 任务 / 成本 / 结果),比两边的十段论点都值钱。

如果你拿不准,今晚就把上面的接入代码跑一遍,用同一个任务对比你现在的模型,把两组结果(成本 / 耗时 / 结果质量)贴在评论区。下周我们把读者的实测结果整理成一篇续篇。

觉得这篇文章对你的团队有用,转发给那个正在纠结「国产模型能不能进生产环境」的同事。

相关阅读

资料来源

  • DeepSeek API 官方文档「Models & Pricing」页,2026-08-13 核验:https://api-docs.deepseek.com/quick_start/pricing/(参数表、定价、涨价预告原文)
  • DeepSeek API 官方文档,Anthropic API 接入说明:https://api-docs.deepseek.com/(Anthropic API 章节)
  • OpenRouter 模型页 deepseek/deepseek-v4-pro-0813,2026-08-12 上线:https://openrouter.ai/deepseek/deepseek-v4-pro-0813
  • Hacker News 讨论帖「DeepSeek V4 Pro 0813」,2026-08-12 提交,785 分:https://news.ycombinator.com/item?id=49274600(社区基准表、价格测算、实测反馈、隐私讨论均出自该帖,引用时已标注评论者)
  • Qwen 官方 Hugging Face 权重页 Qwen3.8-2.4T-A95B,2026-08-12 放出:https://huggingface.co/Qwen/Qwen3.8-2.4T-A95B

本文价格与参数信息核验时间:2026-08-13。官方已预告调价,发布前请对照定价页复核。