强调Next 昨天
2.8 万亿参数说送就送,月之暗面这笔账怎么算的?
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_font3.html

 

7 月 27 日晚,月之暗面如约把 Kimi K3 的完整模型权重挂上了 Hugging Face、GitHub 和 ModelScope。2.8 万亿参数,全球第一个摸到 3 万亿门槛的开放权重模型,任何人都可以免费下载、本地部署、二次开发。

十天前,马斯克刚在 K3 的评测报道下留了句 "Impressive",转头就在社交平台上宣布:xAI 的 2 万亿参数新模型下周完成初训," 可能超越 Kimi"。Kimi 官方只回了一句:" 欢迎马斯克加入 2 万亿俱乐部。"

然后,它直接把俱乐部的门拆了:你们还在比谁的参数大?不好意思,最大的那个,我白送。

这显然不是情怀。翻翻月之暗面过去一个月的动向:6 月中旬 ARR(年度经常性收入)突破 3 亿美元,API 收入占比超过七成。7 月 19 日暂停 C 端新用户订阅。上一轮 200 亿美元估值的融资刚交割,新一轮投前估值已经喊到 315 亿美元。

心细的开发者看到,在 Hugging Face 约 1.56TB 的模型文件旁边,一份只有 3.07KB 的许可证,透露了更多商业信息。

按照 Kimi K3 License,如果一家企业经营 " 模型即服务 " 业务,且企业及其关联方在任意连续 12 个月内的合计收入超过 2000 万美元,在将 K3 及其衍生模型用于商业目的前,必须与月之暗面另行签署协议。

这份许可证把 K3 的话题从技术拉回了生意。

01 月之暗面不想给云厂商免费打工

开放模型一直存在一个尴尬:模型公司承担训练成本,云厂商却可能拿走后续收入。这也是百度李彦宏早些时候提到开源模型没有前景的根本原因。

按照 MIT 许可证,云厂商可以下载模型、优化推理、包装成 API,再利用已有客户、算力和销售渠道收费。模型公司获得下载量和行业声量,客户关系、调用数据和账单却留在云平台。模型迭代越快,实验室越容易变成云厂商的上游研发部门。

K3 的许可证中 " 模型即服务 " 指的是允许第三方对输入、参数或训练数据进行实质性控制。把 K3 能力嵌进自家产品某个具体功能里,或者只是简单转发请求到别的平台,都不算在内。

换句话说,月之暗面没打算拦研发者和大多数企业用户,它拦的是那些下载权重、封装成 API,再用自己的品牌和定价对外销售推理服务的云厂商和推理平台。

海外已经有专注开源基础设施的分析人士,把这道门槛和十年前的往事相提并论。

MongoDB、Confluent 当年也是先靠宽松许可证扩大规模采用。等到亚马逊等云厂商把它们的开源数据库直接包装成收费云服务,原开发商却拿不到分成,它们才被迫转向限制转售的 SSPL、BSL 许可证。

先用开放换规模,再用规则拿回议价权。从超大规模云厂商,到 Fireworks、Together 这类专注模型托管的推理平台,理论上都被 2000 万美元的门槛纳入其中。K3 面对的是与 MongoDB、Confluent 相似的商业挑战,但选择了更温和的法律路径:不直接禁止 MaaS 转售,而是要求达到收入门槛的经营者另行签约。

开放模型行业已经从 " 比谁先开源 "" 比谁开源得彻底 ",走到了 " 比谁能从开放生态里拿回定价权 " 的阶段。

同样是 7 月放出权重,智谱 GLM-5.2 和 DeepSeek V4 Pro 用的还是干净的 MIT 协议,不加任何转售门槛。当然,这也未必是因为它们更慷慨。

至于月之暗面口中可以豁免这条门槛的 " 认证推理伙伴 ",标准和名单目前谁都说不清楚,许可证原文也没有给出定义。

02 从 " 卷参数 " 到 " 卷场景 "

许可证只是 K3 的商业选择。回到模型本身,K3、DeepSeek、GLM 和千问也已经走上了四条不同的路线。

K3 走的是 " 大而全 "。它拥有 2.8 万亿总参数、100 万 token 上下文和原生视觉理解能力。官方演示中,K3 从零编写了一套 GPU 编译器,还参与芯片设计、生成 3D 开放世界游戏。但输入每百万 token 3 美元,输出 15 美元,单任务平均成本约 0.94 美元,是四家中最贵的一个。

DeepSeek V4 Pro 走的是相反路线。它的总参数达到 1.6 万亿,激活参数却压到约 490 亿。输入和输出价格分别为 0.435 美元和 0.87 美元,单任务成本约 0.04 美元。

DeepSeek 还引入了峰谷定价,9 点至 12 点、14 点至 18 点翻倍收费,错峰使用则能节省一半。这与它一贯的打法一致,参数可以大,但激活规模和使用成本必须尽可能低。

智谱 GLM-5.2 选择了第三条路。它采用升级版 DeepSeek Sparse Attention,把百万 token 上下文的推理开销压到通用硬件可以承受的范围。再配合约 400 亿的单 token 激活参数,首字延迟做到三家中最短。

GLM-5.2 的输入、输出价格分别为 1.4 美元和 4.4 美元,落在 K3 与 DeepSeek 之间,重点争夺编码和 Agent 场景里的响应速度。

阿里千问不追求单点极致,追的是覆盖面。上百种语言和更完整的多模态能力,使它更像一套面向企业客户的通用底座,而不是专门用来跑分的旗舰产品。

不过 Kimi 也让阿里坐不住了,K3 发布三天后,阿里预告 Qwen3.8-Max,2.4 万亿参数,明确说也要开放权重。过去一年,开源模型的规模天花板有 9 个月是 Kimi 顶上去的。现在,旗舰级开放权重正在变成中国大模型厂商的标配动作。

四条路线已经无法再用一个维度排座次。" 卷参数 " 开始转向 " 卷场景 ":长文本看 K3,性价比看 DeepSeek,响应速度看 GLM,覆盖面看千问。

差异化也不意味着谁能高枕无忧。DeepSeek、GLM 和千问随时可能继续强化各自的长板,K3 在价格上的劣势也不会自动消失。

03 闭源模型的溢价被挤压

真正让这一轮开放模型显得扎眼的,是跑分与价格的综合对比。

在第三方评测机构 Artificial Analysis 的智能指数榜单上,K3 拿到约 57 分。排在它前面的是 Claude Fable 5 和 GPT-5.6 Sol,分数分别约为 60 分和 59 分;Claude Opus 4.8 则以约 56 分紧随其后。

这是第一次有开放权重模型把成绩做到与顶级闭源模型相差两三分的位置。在 Arena 前端代码榜单上,K3 上线 24 小时内冲到第一,超过 Claude Fable 5,较上一代提升 17 个位次。

更关键的是,这些接近世界顶尖的成绩,对应的价格明显低于多数闭源旗舰。

K3 单任务平均成本约 0.94 美元,约为 Claude Opus 4.8 的一半。如果闭源模型的溢价建立在 " 只有我们能做到这个水平 " 之上,那么当一个开放权重模型把差距压缩到两三分,价格却只有其一半左右,这套溢价逻辑的解释空间就在迅速收窄。

微软 CEO 纳德拉管这叫 " 反向信息悖论 ",买闭源模型其实付了两次钱,一次付账单,一次把喂给模型的业务 know-how 也送了出去。

今年 1 月,纽约一家法院要求 OpenAI 交出 2000 万条脱敏用户对话,更是给所有企业提了个醒:数据在别人服务器上,就由不得你了。K3 给的,正是那个 " 数据不出墙 " 的选项。

04 权重只是开胃菜,真正的战场在推理层

开放权重这件事,在这个阵营里已经不算新闻。DeepSeek、GLM 和千问的旗舰模型早已挂上 Hugging Face,下载、商用和微调都不是问题。

K3 这次真正带来新鲜感的,反而是权重之外的部分。

由于 KDA 改变了传统的前缀缓存机制,月之暗面把自己的缓存实现直接贡献给了 vLLM 项目。权重上线当天,vLLM 和 SGLang 两大主流推理引擎同步提供部署方案。AMD 团队完成了 MI355X 芯片的首日适配,云平台 Modal 上线了 K3 托管服务,Inferact 则训练并开源了适配 K3 的 DSpark 投机解码器。

vLLM 给出的最简部署配置,是 8 张英伟达 B300 或 8 张 AMD MI355X。这两款都是尚未大规模铺货的顶级数据中心芯片,所需算力远非个人开发者能够触及。

这意味着,月之暗面想要的不只是 " 模型更大 " 这个头条。它还想在推理框架和部署工具链中占据一个位置。

权重谁都可以开放。但如果开发者使用的服务方案、缓存实现和投机解码器都围绕你的架构开发,更换模型的成本就不再只是 " 换一个文件 " 那么简单。

许可证中 " 通过认证推理伙伴使用可以豁免转售条款 " 的设计,又给了月之暗面一个开关:谁能进入这套生态,谁需要先坐下来谈判,可以由它筛选。

放出权重是一次性动作,嵌入工具链才有可能真正留住开发者。这也是为什么,K3 这次开放权重更适合被理解为一个开始,而不是终点。

但自定义规则同样有代价。大企业选择开放模型,看重的不只是能力和成本,还包括许可证是否简单、稳定。MIT 和 Apache 2.0 之所以受欢迎,正是因为法务部门容易判断使用边界。

K3 增加了收入门槛、关联方口径、MaaS 定义和认证伙伴等条件,企业部署前需要投入更多合规审查。如果 GLM、DeepSeek 或千问推出能力相近、许可证却更简单的替代品,平台完全可能绕开 K3。

开放模型原本就有较低的切换成本。一次发布带来的技术领先,很难长期支撑一套自定义规则。

据传,K3.1 已经在路上,最快下个月就会发布," 开源—验证—迭代 " 这套打法,可能才刚刚开始被验证。

本文来自微信公众号 " 强调 Next"(ID:leo89203898),作者:新见,36 氪经授权发布。

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

马斯克 kimi 开源 亚马逊 社交平台
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论