AI 前沿·阅读约 2 分钟·
DeepSeek V4 Pro 0813 正式版上线:1M 上下文、384K 输出,价格却涨了

DeepSeek V4 Pro 0813 正式版上线:1M 上下文、384K 输出,价格却涨了

8月12日,DeepSeek V4 Pro 正式版(0813)通过 API 悄然上线:1M 上下文、384K 最大输出、原生支持 Responses API 与 Anthropic 格式,但官方同时预告近期将大幅涨价。

四月·

原创。DeepSeek V4 Pro 正式版 0813 今天悄然上线:1M 上下文、384K 最大输出、全面支持 Responses API 与 Anthropic 格式,缓存命中输入价低至 $0.0036/百万 token——但官方同时预告近期将大幅涨价。

8 月 12 日,DeepSeek V4 Pro 正式版(模型版本号 DeepSeek-V4-Pro-0813)通过 API 悄然上线。没有发布会,没有博客公告,只是 API 文档的模型列表里悄悄多了一个名字——和 7 月 31 日 V4-Flash 正式版上线的方式一模一样。

等了一个月的 Pro 正式版

DeepSeek 的 V4 系列在今年 4 月 24 日放出预览版,之后 Pro 预览版一直是旗舰定位。7 月 31 日 V4-Flash 正式版发布时,官方就预告过"V4-Pro 预计 8 月初跟进"。如今 0813 版本号落地,正式版终于来了。

这次上线的模型参数如下:

参数DeepSeek-V4-Pro-0813
上下文长度1M tokens
最大输出384K tokens
思考模式默认开启,支持切换非思考模式
输入价格(缓存命中)$0.003625 / 1M tokens
输入价格(缓存未命中)$0.435 / 1M tokens
输出价格$0.87 / 1M tokens
并发限制500

对比 V4-Flash(输入 $0.14、输出 $0.28),Pro 的定价大约是 Flash 的 3 倍。作为对比,GPT-5.6 系列和 Claude Opus 4.8 级别的闭源模型定价都在 $2-6 / 1M 输出区间,DeepSeek V4 Pro 的价格依然只有它们的几分之一。

—— 广告 ——

接口全面对齐 OpenAI 生态

正式版 Pro 最值得注意的变化在接口层。根据官方文档,V4 Pro 0813 现在原生支持:

  • OpenAI Responses APIbase_url 指向 https://api.deepseek.com,可以直接在 Codex 等工具里配置使用
  • Anthropic Messages APIbase_urlhttps://api.deepseek.com/anthropic,Claude Code 等工具可直接接入
  • Tool Calls:支持函数调用和 web_search 服务端搜索
  • JSON Output:结构化输出
  • Chat Prefix Completion(Beta)与 FIM Completion(Beta,仅非思考模式)

Responses API 是当前 Agent 生态最主流的接口形态。DeepSeek 之前只有 Flash 支持,现在 Pro 正式版补上了这一块,意味着 deepseek-v4-pro 可以直接作为 Codex 或各类 Agent 框架的底层模型使用。

值得注意的兼容性细节:reasoning 参数支持 effort 控制,storeprevious_response_idmetadata 等参数不支持(API 是无状态的),truncation 不支持——超出上下文窗口直接返回 400 错误。不支持的参数会被静默忽略而不是报错,所以现有 Responses API 客户端可以无缝切换。

缓存价格藏着大杀器

定价表里最显眼的是缓存命中价格:$0.003625 / 1M tokens,只有未命中价格的 1/120。这几乎是所有主流 API 里最激进的缓存定价。

对 Agent 工作负载来说意义重大。一个典型的编码 Agent 会话里,系统提示词、代码库上下文、工具定义这些内容会被反复发送,缓存命中率轻松超过 80%。OpenRouter 上的实时数据显示,DeepSeek V4 Pro 0813 的实际平均输入价格已经低至 $0.04999 / 1M tokens——比官方标价 $0.435 低了近 90%,全靠缓存。

换句话说,长上下文 + 高频复用的场景(Agent、RAG、代码补全)才是这个模型性价比真正爆发的场景。

涨价预告

文档末尾有一段话值得注意:"我们计划在不久的将来提高 DeepSeek API 服务的整体定价,预计涨幅显著。请合理安排您的使用。具体定价方案以官方通知为准。"

结合 8 月 8 日 AMD 宣布收购 Taalas(DeepSeek 的算力供应商之一)的新闻,这轮涨价预告多少有点"算力成本要重新谈判"的味道。V4 Pro 正式版以低价开场、同时预告涨价,意味着现在的价格窗口可能是未来几个月内最划算的时段。

对于已经在用 DeepSeek API 的开发者,建议:

  • 如果用量大,先关注官方公告,涨价落地前囤量
  • Agent 类场景尽量利用缓存命中,把输入成本压到最低
  • 关注 0813 与 Flash 的分工:重活交给 Pro,轻量任务继续用 Flash 省钱

写在最后

DeepSeek 这次延续了"悄悄上线、文档说话"的风格。V4 Pro 正式版把 1M 上下文、384K 输出、双接口生态全部补齐,定价依然是主流闭源模型的零头。加上涨价预告,现在的价格窗口值得珍惜。模型本身的能力表现如何,等第三方基准跑完我们再聊。

分享到
微博Twitter

© 2026 四月

原文链接:https://www.aprilzz.com/ai/deepseek-v4-pro-0813