IT 时代网 9 月 14 日消息,有爆料称 DeepSeek 即将发布名为 Code 2.0 的大模型,发布窗口在 9 月份,预计性能将击败当前最强大的两个前沿级大模型,并继续保持开源开放。
爆料称,Code 2.0 的设计重点是 Computer Use 电脑控制,让 AI 替代人操作电脑完成大量工作,参数量高达 3 万亿以上。作为参照,国内目前参数量最大的是 K3 大模型的 2.8 万亿,千问 Qwen 3.8 Max 为 2.4 万亿,DeepSeek 自家 V4 Pro 为 1.6 万亿。
这一参数量级具备一定可信度。本周 DeepSeek 刚发布 V4.1 Flash,新架构使参数量翻倍,从当前 1.6 万亿提升到 3 万亿,才能与前沿大模型竞争性能上限。
另据消息,Pro 系列新品确定为 V4.1 Pro,具体升级内容尚未公布。

注:本文中包含 AI 辅助创作的内容。


登录后才可以发布评论哦
打开小程序可以发布评论哦