好机友 11小时前
DeepSeek V4 Pro正式版突然上线,这是要掀桌子啊
index.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

在大模型领域,有一个很知名的梗:

" 去别的地方玩,不要耽误 AGI 训练。"

表面上是在调侃,实际上是在夸 DeepSeek 猛如虎。

而机哥之所以提起这小鲸鱼。

是因为在今天凌晨,DeepSeek 突袭放出了 deepseek-v4-pro 正式版,版本号「DeepSeek-V4-Pro-0813」。

正如 deepseek-v4-flash 预览版和正式版的区别。

deepseek-v4-pro 正式版,相比起 7 月发布的内个预览版,整体性能不能说略微提升,简直是挤爆牙膏。

先给机友们看下,DeepSeek 官方给出的大模型测试对比图。

它在终端操作 Terminal Bench 测试中拿到 87.9 分,和 Fable 5 的 88 分几乎贴着打。

而在代表着高难度推理能力的 HLE 测试。

deepseek-v4-pro 同样重拳出击,拿到 60 分,仅次于 Fable 5。

各项基准测试看下来。

v-4pro 正式版未必全都能拿第一,但大多数情况下都能跟最顶级的几个模型打得难分难解。

在机哥看来,这才是最特么恐怖的事情。

因为它的价格实在是太便宜了。

在百万上下文、最大输出 384K、综合能力拉满的情况下。

依旧比大洋彼岸的顶级模型,便宜好几十倍,也只比自家 flash 正式版贵 3 倍。

对此我只能说。

以前大伙怎么称呼梁文锋,他都可以既往不咎。

但现在你应该叫他什么?

除了能力暴涨。

DeepSeek-v4-pro 正式版,还有个小升级。

比如原生支持了 Responses API 和 Anthropic 格式,开发者大佬们应该很喜闻乐见。

机哥建议大伙,想用的话,现在就开始狠狠薅它。

因为前阵子 DeepSeek 发过公告,表示:

"API 服务近期预计将迎来整体较大幅度的涨价。"

但不管怎么说。

DeepSeek 这波更新,依旧给其余模型上了压力。

跑得快的没奖励,跑得慢的被咔嚓。

图片来自网络

贪玩蓝鲸又上线咯

评论
大家都在看