星河商业观察 20小时前
Kimi、千问、DeepSeek连放大招,有的服务器挤爆了
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

今年这个七月,大模型圈比三伏天还热闹。

7 月 19 日,月之暗面紧急暂停 C 端新用户订阅,优先保障存量用户体验。

刚登顶全球代码评测榜、被称作 " 中国 Fable 5 时刻 " 的 Kimi K3 大模型,发布仅三天就因用户量暴涨触发算力告急。

Kimi K3 于 7 月 16 日正式发布,总参数规模冲到 2.8 万亿,是目前全球参数最大的开源模型,全系标配 100 万 token 上下文窗口,还原生支持多模态视觉理解。技术上搭载 KDA 混合线性注意力机制,靠稀疏专家框架控制推理成本。

官方表态,它的综合能力仍落后于 Claude Fable 5 与 GPT-5.6 Sol,但已经能稳定领先其余主流大模型。

Kimi 刚把参数门槛拉到新高度,阿里千问立刻接棒冲榜。

7 月 19 日,通义实验室放出千问 Qwen3.8 预览版,总参数 2.4 万亿,架构升级为动态稀疏自适应门控。正式版拟近期开源。千问团队给它的定位为性能仅次于 Fable 5,属于当今最强模型之列。

和前两家死磕性能参数的路子不同,DeepSeek 依然焊死 " 性价比卷王 " 的标签。

DeepSeek V4 预览版早在今年 4 月便已上线并同步开源,有行业人士预测正式版最早会在 7 月 20 日全量落地,V4 分为 Pro 与 Flash 两个版本,旗舰版 V4-Pro 参数 1.6 万亿,全系列支持 100 万 token 超长上下文。

官方实测数据显示,正式版推理计算量仅为前代 V3.2 的 27%,显存占用降至前代的 10%。商业玩法更激进,在国内大模型行业率先推出峰谷分时定价,平峰时段 API 价格仅为海外同级闭源模型的约七分之一,把成本优势拉到了极致。

各家说得再热闹,不如检验模型的真实性能成色。

从 7 月中旬更新的 LMArena 综合榜单来看,Anthropic 的 Claude Fable 5 稳居 ELO 积分榜首,前五名均被海外闭源模型包揽;当时国产阵营里排名最高的 Qwen3.7-Max 处于全球中上游位次,但和第一梯队还有明显差距。

但三款新模型陆续落地后,这个差距正在快速缩小,部分赛道甚至实现反超。

第三方机构 Artificial Analysis 的数据显示,Kimi K3 在 Frontend Code Arena 前端代码竞技场拿到 1679 分,直接登顶全球第一,性能超过 Claude Fable 5;综合智能指数得分 57,成功跻身全球第一梯队。而根据千问团队的内部测试结果,Qwen3.8 的编码能力与 Fable 5 的差距缩小至 12.6 分,在协同智能体任务上的表现已超越 Claude Opus 4.8 Max。

国产大模型正在不断提高研发节奏,利用开源开放 + 极致性价比的组合打法,慢慢撬动全球 AI 产业的既有格局。等三款新模型的完整第三方评测全部出炉,全球大模型的座次表,大概率还会迎来新一轮调整。

来源:星河商业观察

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

kimi 开源 用户体验 三伏天 阿里
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论