快科技 9 月 13 日消息,本周 DeepSeek 发布了 V4.1 Flash,这个大模型架构变化之大,完全可以称得上是 V5 了,但 DeepSeek 很低调地没换大版本号。
Pro 系列的新品确定了是 V4.1 Pro,具体升级还没公布,如果是 V4 到 V4.1 这样的提升幅度,那 V4.1 Pro 性能上限也会很高,但考虑到之前 V4 Pro-0813 正式版的不及预期,大家期待值不要拉太高。
后续还有一波大模型,爆料者称它叫做 DeepSeek Code 2.0,即将发布,时间窗口是 9 月份,预计性能会击败 Mythos 5.1 和 GPT-6 Astra,这是当前最强大的两个前沿级大模型。
其他方面,DeepSeek Code 2.0 预计会继续保持开源开放,设计重点是 Computer Use,也就是电脑控制,AI 替代你操作电脑完成很多工作,Astra 目前很多让人惊讶的使用就来自这一方面。

这个 Code 2.0 拥有高达 3 万亿以上的参数量,显然这也是它提高性能的关键,这方面国内目前最强的是 K3 大模型的 2.8 万亿,千问的 Qwen 3.8 Max 是 2.4 万亿参数量,DeepSeek V4 Pro 是 1.6 万亿参数。
从 V4.1 Flash 换用新结构使得参数量翻倍来看,这个 Code 2.0 从当前 1.6 万亿提升到 3 万亿参数的可信度是有的,想跟 Mythos 5.1 及 Astra 这样的大模型竞争就需要这个级别的参数量,不然性能上限是很难提升的。
这个爆料的可信度不好说,DeepSeek 过去的 23-24 年倒是推出过三款名字带 Code 的大模型,不过那时候表现平平,这次要是重推偏向代码 / 逻辑的 Code 大模型,作为旗舰级产品倒也不失为一个方向,就让 V4.1 Pro 及 Flash 面向通用 Agent 任务即可。



登录后才可以发布评论哦
打开小程序可以发布评论哦