手机中国 昨天
国产大模型四天密集出牌 Kimi K3与DeepSeek V4各走各路
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

【CNMO 科技消息】7 月 16 日至 20 日,国产大模型领域迎来一波密集发布潮。月之暗面 Kimi K3、DeepSeek V4 满血版以及通义千问 Qwen 3.8 在四天之内相继亮相,三家厂商以不同的产品策略切入市场,标志着国产大模型的竞争维度正从单一指标向综合能力与价格体系的多维博弈转变。

月之暗面 Kimi

首先,Kimi K3 于 7 月 16 日正式发布,核心参数为 2.8 万亿参数规模和 100 万 Token 上下文窗口。在编程能力评测中,K3 在 Program Bench 上得分 77.8,超过 GPT-5.6 Sol 的 77.6;在 FrontierSWE 上得分 81.2,大幅领先 GPT-5.6 Sol 的 71.3。两项关键指标实现反超。Terminal Bench 得分 88.3,与 GPT-5.6 Sol 差距仅 0.5 分。月之暗面表示,K3 整体仍落后于 Fable 5 和 GPT-5.6 Sol,但编程单项已摸到海外闭源模型的水平线。

DeepSeek V4 目前处于灰度测试阶段,官方尚未发布正式公告。已知信息包括 Flash 和 Pro 两个版本,SWE-bench 自测成绩距 Opus 4.6 Max 差 0.2 个百分点。API 定价首次引入峰谷计费机制:Pro 版百万输出 Token 平时 0.87 美元,高峰时段 1.74 美元。这一价格与 Fable 5 的 50 美元相比,差距达到一个数量级

两家厂商的路线分化已十分明显。Kimi K3 选择在编程榜单上与海外闭源模型正面对标,以能力上限作为核心卖点;DeepSeek V4 则将 Opus 级别的能力压缩至七分之一的价格,以成本优势撬动市场。前者卷的是能力天花板,后者卷的是能力下限的价格门槛。

DeepSeek

这种分化意味着国产大模型的竞争逻辑正在发生根本性变化。当性能逼近和价格压制同时发生时,用户选择模型的依据不再局限于单一跑分或单一价格,而是需要在能力、成本、迭代效率等多个维度之间进行权衡。

版权所有,未经许可不得转载

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

kimi 编程 通义千问 高峰 flash
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论