
DeepSeek V4 Pro 0813 正式版上线:1M 上下文、384K 输出,价格却涨了
8月12日,DeepSeek V4 Pro 正式版(0813)通过 API 悄然上线:1M 上下文、384K 最大输出、原生支持 Responses API 与 Anthropic 格式,但官方同时预告近期将大幅涨价。
原创。DeepSeek V4 Pro 正式版 0813 今天悄然上线:1M 上下文、384K 最大输出、全面支持 Responses API 与 Anthropic 格式,缓存命中输入价低至 $0.0036/百万 token——但官方同时预告近期将大幅涨价。
8 月 12 日,DeepSeek V4 Pro 正式版(模型版本号 DeepSeek-V4-Pro-0813)通过 API 悄然上线。没有发布会,没有博客公告,只是 API 文档的模型列表里悄悄多了一个名字——和 7 月 31 日 V4-Flash 正式版上线的方式一模一样。
等了一个月的 Pro 正式版
DeepSeek 的 V4 系列在今年 4 月 24 日放出预览版,之后 Pro 预览版一直是旗舰定位。7 月 31 日 V4-Flash 正式版发布时,官方就预告过"V4-Pro 预计 8 月初跟进"。如今 0813 版本号落地,正式版终于来了。
这次上线的模型参数如下:
| 参数 | DeepSeek-V4-Pro-0813 |
|---|---|
| 上下文长度 | 1M tokens |
| 最大输出 | 384K tokens |
| 思考模式 | 默认开启,支持切换非思考模式 |
| 输入价格(缓存命中) | $0.003625 / 1M tokens |
| 输入价格(缓存未命中) | $0.435 / 1M tokens |
| 输出价格 | $0.87 / 1M tokens |
| 并发限制 | 500 |
对比 V4-Flash(输入 $0.14、输出 $0.28),Pro 的定价大约是 Flash 的 3 倍。作为对比,GPT-5.6 系列和 Claude Opus 4.8 级别的闭源模型定价都在 $2-6 / 1M 输出区间,DeepSeek V4 Pro 的价格依然只有它们的几分之一。
—— 广告 ——
接口全面对齐 OpenAI 生态
正式版 Pro 最值得注意的变化在接口层。根据官方文档,V4 Pro 0813 现在原生支持:
- OpenAI Responses API:
base_url指向https://api.deepseek.com,可以直接在 Codex 等工具里配置使用 - Anthropic Messages API:
base_url为https://api.deepseek.com/anthropic,Claude Code 等工具可直接接入 - Tool Calls:支持函数调用和 web_search 服务端搜索
- JSON Output:结构化输出
- Chat Prefix Completion(Beta)与 FIM Completion(Beta,仅非思考模式)
Responses API 是当前 Agent 生态最主流的接口形态。DeepSeek 之前只有 Flash 支持,现在 Pro 正式版补上了这一块,意味着 deepseek-v4-pro 可以直接作为 Codex 或各类 Agent 框架的底层模型使用。
值得注意的兼容性细节:reasoning 参数支持 effort 控制,store、previous_response_id、metadata 等参数不支持(API 是无状态的),truncation 不支持——超出上下文窗口直接返回 400 错误。不支持的参数会被静默忽略而不是报错,所以现有 Responses API 客户端可以无缝切换。
缓存价格藏着大杀器
定价表里最显眼的是缓存命中价格:$0.003625 / 1M tokens,只有未命中价格的 1/120。这几乎是所有主流 API 里最激进的缓存定价。
对 Agent 工作负载来说意义重大。一个典型的编码 Agent 会话里,系统提示词、代码库上下文、工具定义这些内容会被反复发送,缓存命中率轻松超过 80%。OpenRouter 上的实时数据显示,DeepSeek V4 Pro 0813 的实际平均输入价格已经低至 $0.04999 / 1M tokens——比官方标价 $0.435 低了近 90%,全靠缓存。
换句话说,长上下文 + 高频复用的场景(Agent、RAG、代码补全)才是这个模型性价比真正爆发的场景。
涨价预告
文档末尾有一段话值得注意:"我们计划在不久的将来提高 DeepSeek API 服务的整体定价,预计涨幅显著。请合理安排您的使用。具体定价方案以官方通知为准。"
结合 8 月 8 日 AMD 宣布收购 Taalas(DeepSeek 的算力供应商之一)的新闻,这轮涨价预告多少有点"算力成本要重新谈判"的味道。V4 Pro 正式版以低价开场、同时预告涨价,意味着现在的价格窗口可能是未来几个月内最划算的时段。
对于已经在用 DeepSeek API 的开发者,建议:
- 如果用量大,先关注官方公告,涨价落地前囤量
- Agent 类场景尽量利用缓存命中,把输入成本压到最低
- 关注 0813 与 Flash 的分工:重活交给 Pro,轻量任务继续用 Flash 省钱
写在最后
DeepSeek 这次延续了"悄悄上线、文档说话"的风格。V4 Pro 正式版把 1M 上下文、384K 输出、双接口生态全部补齐,定价依然是主流闭源模型的零头。加上涨价预告,现在的价格窗口值得珍惜。模型本身的能力表现如何,等第三方基准跑完我们再聊。
© 2026 四月
原文链接:https://www.aprilzz.com/ai/deepseek-v4-pro-0813
相关文章
DeepSeek-V4-Flash 正式版发布:Agent 能力反超自家 Pro 预览版,输出只要 2 元/百万 token
2026年7月31日,DeepSeek-V4-Flash 正式版 API 上线公测:9 项 Agent 基准全面反超 V4-Pro-Preview,原生支持 Responses API 并适配 Codex,输出价格仅 2 元/百万 token。
DeepSeek V4 预览版全面解读:1M 上下文、1.6T MoE、开源逼近闭源前沿
DeepSeek 于 2026 年 4 月 24 日正式发布 V4 预览版,包含 Pro 和 Flash 两个版本,以 1.6T 总参数、1M 上下文窗口、极低 API 定价冲击 AI 格局。本文基于官方技术报告与 HuggingFace 开源模型信息,全面解读其架构创新、性能表现与行业影响。
Anthropic 发布 Claude Opus 5:近 Fable 级别的智能,一半的价格
Anthropic 于 2026 年 7 月 24 日发布 Claude Opus 5,全新旗舰模型在编码、科学研究和知识工作等多项基准上超越前代 Opus 4.8 近两倍性能,定价仅为 Fable 5 的一半