星河商业观察 1小时前
同夜对垒:DeepSeek V4 Pro正式版撞上Grok 4.6
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

8 月 12 日深夜,DeepSeek 把 API 文档里的模型版本更新为 "DeepSeek-V4-Pro-0813"。几乎同一时间,马斯克旗下 xAI(SpaceXAI)推出新一代旗舰模型 Grok 4.6。

两款模型同夜上线,把全球 AI 行业的目光拉回同一条赛道:智能体(Agent)。

今年 4 月底,DeepSeek API 刚上线 V4 Pro 与 V4 Flash 预览时,更新日志便预告正式版随后跟上。

如今正式版落地,核心参数在国产模型中处于头部水平:上下文长度 100 万 Token,最大输出 384K Token,默认开启思考模式,同时支持 JSON 输出、工具调用、Responses API,并兼容 Anthropic API 格式,并发限制为 500。开发者无需修改调用名称,直接调用 deepseek-v4-pro 即可使用最新版本。

真正让开发者关注的是跑分变化。

据 DeepSeek 官方群流出的评测对比表,V4 Pro 正式版在衡量真实终端任务完成能力的 Terminal Bench 2.1 上拿到 87.9 分,距离 Anthropic 旗舰模型 Fable 5 的 88.0 分仅差 0.1 分;在网络安全智能体测试 CyberGym 上以 83.3 分反超 Fable 5 的 83.1 分。

最夸张的是软件工程基准 DeepSWE,从预览版的 12.8 分跃升至 62.7 分,接近五倍,超过 Anthropic 上一代旗舰 Opus 4.8 的 58.0 分。

需要说明的是,这些数据来自官方群与社区流传,DeepSeek 尚未发布正式更新日志,严格来说属于非官方披露。

价格是这次更新的另一个看点。

V4 Pro 正式版暂未调价,每百万 Token 缓存命中输入 0.025 元、缓存未命中输入 3 元、输出 6 元,与预览版一致。对比 V4 Flash 的 0.02 元、1 元、2 元,Pro 输出价格正好是三倍。

放眼全球,价格差距更为悬殊:Fable 5 每百万输出 Token 定价 50 美元,GPT-5.6 Sol Max 为 30 美元,Grok 4.6 为 6 美元,而 DeepSeek V4 Pro 仅为 0.87 美元,约为 Fable 5 的五十七分之一。

0.1 分的跑分差距背后,是数十倍的价格鸿沟,足以让每个开发者重新审视技术选型。

同夜上线的 Grok 4.6 同样主打高性价比:每百万输入 Token 定价 2 美元、输出 6 美元,上下文窗口 50 万 Token。在 Artificial Analysis 智能指数中拿到 61 分,与 OpenAI 的 GPT-5.6 Sol 持平;在 GDPVal-AA v2 评估中以 1753 Elo 登顶,超过 Fable 5 的 1741 分。

这次撞车发生时,DeepSeek 刚预告过一轮涨价。

8 月 6 日,开发者登录 API 后台看到提示:" 计划近期整体上调 DeepSeek API 服务的定价,预计涨幅较大。" 这是 DeepSeek 首次预告整体上调价格。

此前,V4 Flash 调用量持续攀升,OpenRouter 数据显示,7 月 27 日至 8 月 2 日当周其以 7.11 万亿 Token 位居全球第一,8 月 4 日甚至因访问量激增出现容量不足。算力成本同步上涨,2026 年一季度国内 AI 算力需求同比暴涨 417%,供给增速仅 128%。

从 4 月首发优惠、5 月永久降价到 6 月引入峰谷计费,再到如今的涨价预告,DeepSeek 正在从 " 价格屠夫 " 转向谋求定价权的技术产品。这可能标志着自 4 月底以来持续的激进价格竞争进入尾声,行业整体价格体系开始向真实成本回归。

来源:星河商业观察

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

flash 马斯克 网络安全
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论