【TechWeb】8 月 13 日消息,DeepSeek 在深夜正式推出 V4 Pro 正式版模型 DeepSeek-V4-Pro-0813,API 及 Chat 端已同步完成更新,调用模型名不变,开发者使用 deepseek-v4-pro 即可调用最新版本。
根据官方公布的评测数据显示,该模型在多项 Agent 相关评测集上超越 Opus 4.8,与 Fable 5(w/ fallback)互有胜负。
根据 DeepSeek 官方 API 文档,DeepSeek-V4-Pro-0813 支持 1M 上下文长度,最大输出长度达 384K Token,同时支持非思考模式与思考模式,其中思考模式默认开启。对于长代码库分析、大规模文档处理以及需要连续执行大量步骤的 Agent 任务而言,这样的上下文和输出规格意味着单次调用的承载能力相当可观。
配套能力方面,新模型支持 JSON Output、Tool Calls、Responses API 和 Anthropic API,对话前缀续写与 FIM 补全处于 Beta 阶段,其中 FIM 补全仅限非思考模式使用。API 接入同时兼容 OpenAI 和 Anthropic 两套格式,官方还明确新版本增强了 Agent 能力,支持 Codex 接入。
性能方面,从官方公布的对比表来看,V4-Pro-0813 相比预览版提升显著:HLE(带工具)从 48.2 升至 60.0,Terminal Bench 2.1 从 72.1 升至 87.9,DeepSWE 从 12.8 跃升至 62.7,DSBench-Hard 从 31.1 升至 67.2。
横向对比中,该模型整体表现超越 Opus 4.8,在 Terminal Bench 2.1(87.9 对 88.0)、Cybergym(83.3 对 83.1)等项目上与 Fable 5 几乎打平,但在 DSBench-FullStack(71.1 对 77.2)等项目上仍有差距。
价格方面,deepseek-v4-pro 当前每百万 Token 定价为:缓存命中输入 0.025 元、缓存未命中输入 3 元、输出 6 元,三项主要计费标准均为 deepseek-v4-flash(0.02 元、1 元、2 元)的 3 倍。并发限制上,Pro 版为 500,Flash 版为 2500。相比之下,Flash 主打高频大规模调用,Pro 则面向规格要求更高的任务。
值得一提的是,DeepSeek 此前已公告称计划近期整体上调 API 服务定价且 " 预计涨幅较大 ",但目前价格页面仍维持原价,具体调价方案尚未公布。


