在大模型领域,有一个很知名的梗:
" 去别的地方玩,不要耽误 AGI 训练。"
表面上是在调侃,实际上是在夸 DeepSeek 猛如虎。
而机哥之所以提起这小鲸鱼。
是因为在今天凌晨,DeepSeek 突袭放出了 deepseek-v4-pro 正式版,版本号「DeepSeek-V4-Pro-0813」。
正如 deepseek-v4-flash 预览版和正式版的区别。
deepseek-v4-pro 正式版,相比起 7 月发布的内个预览版,整体性能不能说略微提升,简直是挤爆牙膏。
先给机友们看下,DeepSeek 官方给出的大模型测试对比图。
它在终端操作 Terminal Bench 测试中拿到 87.9 分,和 Fable 5 的 88 分几乎贴着打。
而在代表着高难度推理能力的 HLE 测试。
deepseek-v4-pro 同样重拳出击,拿到 60 分,仅次于 Fable 5。
各项基准测试看下来。
v-4pro 正式版未必全都能拿第一,但大多数情况下都能跟最顶级的几个模型打得难分难解。
在机哥看来,这才是最特么恐怖的事情。
因为它的价格实在是太便宜了。
在百万上下文、最大输出 384K、综合能力拉满的情况下。
依旧比大洋彼岸的顶级模型,便宜好几十倍,也只比自家 flash 正式版贵 3 倍。
对此我只能说。
以前大伙怎么称呼梁文锋,他都可以既往不咎。
但现在你应该叫他什么?
除了能力暴涨。
DeepSeek-v4-pro 正式版,还有个小升级。
比如原生支持了 Responses API 和 Anthropic 格式,开发者大佬们应该很喜闻乐见。
机哥建议大伙,想用的话,现在就开始狠狠薅它。
因为前阵子 DeepSeek 发过公告,表示:
"API 服务近期预计将迎来整体较大幅度的涨价。"
但不管怎么说。
DeepSeek 这波更新,依旧给其余模型上了压力。
跑得快的没奖励,跑得慢的被咔嚓。
图片来自网络
贪玩蓝鲸又上线咯
↘↘↘


