按作者出 12小时前
梁文锋深夜对垒马斯克,给全球最强上压力?
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

文 / 观网硬科技

8 月 12 日深夜,DeepSeek 官网 API 文档更新,模型版本从 V4-Pro 预览版切换为 "DeepSeek-V4-Pro-0813"。几乎同一时间,马斯克旗下 SpaceXAI 发布了新一代模型 Grok 4.6。

两款主打高性价比的模型同夜撞车,梁文锋与马斯克的双强对垒,真正感受到压力的可能是 OpenAI 和 Anthropic。

从 DeepSeek 官方群流出的一张评测对比表显示,V4 Pro 正式版在多项智能体测试中表现亮眼。在衡量 AI 智能体完成真实终端环境复杂任务能力的 Terminal Bench 2.1 上,V4 Pro 拿下 87.9 分,距离全球第一的 Anthropic Fable 5 仅差 0.1 分。相比预览版 72.1 分的成绩,三个月跃升了 15.8 分。

在 AI 安全智能体基准 Cybergym 上,V4 Pro 以 83.3 分压过 Fable 5 的 83.1 分;在工作流智能体测试 AutomationBench 中,31.8 分对 29.1 分同样胜出。

衡量软件工程能力的 DeepSWE 上,分数从预览版的 12.8 分飙升至 62.7 分,接近原来的五倍,超越了 Anthropic 上一代旗舰 Opus 4.8 的 58.0 分。V4 Pro 正式版支持 100 万 Token 上下文长度,最大输出 384K Token,并兼容 OpenAI 和 Anthropic 两种 API 格式,开发者几乎无需修改代码即可完成切换。

智能体是理解这次升级的关键。Terminal Bench、DeepSWE 这类测试考察的是 AI 能不能真正 " 干活 " ——调用工具、执行多步骤任务、编写和修改代码、在长链条中持续推进直到交付结果。这正是大模型从聊天玩具走向生产工具的核心门槛。

就在 V4 Pro 上线前几个小时,马斯克旗下 SpaceXAI 发布的 Grok 4.6 同样剑指长周期智能体任务。在面向真实知识工作的 GDPVal-AA v2 评估中,Grok 4.6 以 1753 Elo 登顶,超过了 Fable 5 的 1741 和 GPT-5.6 Sol Max 的 1728。两款模型不约而同地将矛头指向同一件事:让 AI 在长任务中稳定交付可用成果。

然而价格差距令人咋舌。Fable 5 每百万输出 Token 定价 50 美元,GPT-5.6 Sol Max 为 30 美元,Grok 4.6 为 6 美元,而 DeepSeek V4 Pro 仅为 0.87 美元,约为 Fable 5 的五十七分之一。0.1 分的跑分差距背后,是五十七倍的价格鸿沟。

DeepSeek 此次发布的另一重看点,是其智能体工具 "Harness" 的推进。有媒体报道,DeepSeek Harness 于 2026 年 5 月内部立项,由崔添翼担任负责人。

崔添翼毕业于浙江大学计算机系,曾在量化交易机构 Jane Street 任职九年,2026 年 3 月加入 DeepSeek。"DeepSeek Harness 团队 " 公众号已于今年 7 月 6 日正式注册。8 月 1 日,崔添翼曾面向全球公开征集 Harness 内测用户。

性能飙升的同时,涨价预告也随之而来。8 月 6 日,DeepSeek 在开放平台发布公告,计划近期整体上调 API 服务定价,预计涨幅较大。这是 DeepSeek 首次预告整体上调 API 价格,而非此前针对高峰时段的局部调整。

梳理其定价时间线:4 月 V4 发布时,V4 Pro API 以 2.5 折优惠上线;5 月 31 日优惠结束后,直接永久降至原价的四分之一;6 月 29 日又引入峰谷计费。从永久降价到预告大涨,中间只隔了两个多月。

如果只把涨价理解为 " 扛不住成本 ",可能低估了 DeepSeek 的意图。仅仅两个月前的 6 月 16 日,DeepSeek 刚刚完成成立以来首轮外部融资,募资总额超过 500 亿元人民币,投后估值突破 3500 亿元,创下中国 AI 行业单轮融资纪录。

最新消息显示,DeepSeek 已在推动第二轮融资,计划募资约 500 亿元,投前估值约 5000 亿元。摩根士丹利 8 月 9 日发布的研报给出了三个驱动因素:V4 模型需求旺盛支撑了更强的定价能力;厂商需要在市场份额与毛利率之间寻求平衡,以持续投入前沿模型研发;更多使用国产芯片可能带来更高的推理成本。

报告认为,模型智能而非价格,才是大模型竞争的终极壁垒。

DeepSeek 的涨价并非孤例。据摩根士丹利统计,以字节跳动、阿里、百度、腾讯、智谱、月之暗面、MiniMax 及 DeepSeek 为样本,中国大模型平均 API 输出价格已从 2025 年一季度的约 12.2 元 / 百万 Token 回升至 2026 年二季度的 21.9 元 / 百万 Token。智谱 API 定价较去年底累计上调约 83%,但调用量反而增长了 400%。腾讯在 3 月至 4 月间两轮上调模型 API 价格,部分涨幅高达 463%。

纵观整个 AI 行业,算力供需、芯片采购成本、运营成本持续走高,单纯靠低价换规模的模式难以为继。当头部厂商都不再以价格为唯一竞争手段,行业下半场的焦点已经明确:不是谁更便宜,而是谁真能解决问题。

本文系观察者网独家稿件,未经授权,不得转载。

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

马斯克 撞车
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论