8 月 13 日,DeepSeek 官方把 V4 Pro 从预览版正式转正了。官方定价页上,模型版本号已经更新为 DeepSeek-V4-Pro-0813。

DeepSeek-V4-Pro-0813 为版本型号 ( 网站截图 )
这次转正并非临时起意。4 月底,官方 API 刚支持 V4-Pro 和 V4-Flash 的时候,就在更新日志里预告过,V4-Pro 的正式发布会随后跟上。如今,它正式来了。
1M 上下文 +384K 输出,长文档处理更从容
DeepSeek V4 Pro 正式版的核心参数相当能打:上下文长度达到 1M,最大输出 384K Token,支持 thinking 模式和非 thinking 模式,默认开启 thinking 模式。同时支持 JSON 输出、工具调用、Responses API,兼容 Anthropic API 格式,并发限制为 500.
1M 上下文在国产模型里属于头部水平。配合 384K 输出,处理长文档、长代码仓库这类任务比上一代从容得多。对于长代码库、大规模文档处理以及需要连续执行大量步骤的 Agent 任务来说,这意味着一次调用能够容纳和生成的内容规模都相当可观。
配套能力也基本覆盖了目前主流的 Agent 开发需求,支持 JSON Output、Tool Calls、Responses API、Anthropic API,同时支持 Beta 阶段的对话前缀续写与 FIM 补全,其中 FIM 补全仅限非思考模式使用。
价格比 Flash 贵三倍,并发限制更严格
DeepSeek V4 Pro 是走量的高端档,价格明显高于 V4-Flash。按每 1M token 计算,缓存命中输入 0.025 元,缓存未命中输入 3 元,输出 6 元。相比之下,V4-Flash 分别为 0.02 元、1 元和 2 元。输出 token 从 2 元涨到 6 元,正好是三倍。输入未命中从 1 元涨到 3 元,也是三倍。

两者的并发限制也有所区别:V4-Flash 的并发限制为 2500.V4-Pro 则为 500. 从价格和并发配置来看,Flash 更明显地面向高频、大规模调用场景,而 Pro 则把资源进一步集中到规格更高的任务上。需要提醒的是,DeepSeek 官方从来没有把 V4-Pro 标成免费。V4-Flash 7 月 31 日进入 public beta,一直按 token 计费。V4 Pro 同样按量收费。
官方预告整体涨价,涨幅较大
这次定价页上,官方在价格表下方挂了一条重要注释:" 计划近期整体上调 DeepSeek API 服务的定价,预计涨幅较大,请合理安排您的使用,具体方案以正式通知为准。"
这条信息比 V4 Pro 转正本身更值得关注。换句话说,这也是官方给用户打 " 预防针 "。
打算长期使用 DeepSeek API 的,尤其是重度调用方,可能需要趁当前价格囤一点额度,或者提前评估涨价后的成本。不过具体涨多少、什么时候涨,官方还没给出正式方案,需要等后续通知。
调用方式没有变化。base_url 不变,把 model 参数改成 deepseek-v4-pro 就行。走 OpenAI 兼容接口,或者在官方文档提到的 Anthropic 接口 ( api.deepseek.com/anthropic ) 里设置成对应模型名,两种都能用。旧的两个模型名 deepseek-chat 和 deepseek-reasoner,在 7 月 24 日已经停用,现在分别指向 V4-Flash 的非 thinking 和 thinking 模式,用 API 的老用户需要注意。

Flash 够用就别急着上 Pro
对大多数日常任务,DeepSeek V4 Flash 的 0731 版本已经够用。官方那批 agent 能力数据 ( Terminal Bench 82.7、Cybergym 76.7 等 ) ,标的是 V4-Flash 0731 相比 V4-Pro-Preview 的提升,并非 V4-Pro 正式版的数据,这一点需要看清。
如果只做聊天、轻量编程、日常问答,Flash 的性价比明显更高。需要处理超长上下文、复杂 Agent 任务,或者对输出质量有更高要求,才值得为 Pro 的三倍价格买单。
随着 DeepSeek-V4-Pro-0813 正式上线,V4 系列的产品结构也进一步清晰起来:Flash 主打更低成本和更高并发,Pro 则提供更高规格的模型服务,并围绕 Tool Calls、Responses API、Anthropic API 等能力继续向 Agent 和 Coding 场景延伸。


登录后才可以发布评论哦
打开小程序可以发布评论哦