月之暗面迄今能力最强的模型开源了。
7 月 27 日晚上十一点,月之暗面发布 Kimi K3 的模型权重、技术报告,并开源支撑 Kimi K3 模型训练的关键 Infra 技术:MoonEP、FlashKDA 和 AgentEnv。这意味着,每个人都可以下载并部署 Kimi K3 模型——无论是用于内部研发,还是嵌入到面向终端用户的产品中,均可自由使用。

Kimi K3 发布于 7 月 17 日凌晨,是一个拥有 2.8 万亿参数的混合专家(MoE)模型,具备原生视觉理解能力,并支持 100 万 token 的上下文窗口。
同时,它也是全球首个开源的 3 万亿级别模型,面向长程编程、知识工作和推理等前沿智能场景而设计。
该模型开源后,Hugging Face CEO Clem Delangue 发文,Kimi K3 在 30 分钟内以超过 4000 个赞登顶趋势榜," 迄今为止最快的发布增长速度!!"

Kimi K3 开源同日,多家 AI 生态链公司宣布接入 Kimi K3。
国内,华为昇腾 CANN 宣布,昇腾 950 全系列、AtlasA3 产品支持 Kimi K3 部署,其表示,Kimi K3 896 专家的大 EP 部署场景,能够充分发挥昇腾超节点架构优势。同时,趋境科技基于开源推理引擎 SGLang 完成了 Kimi K3 在昇腾 AtlasA3 上的 Day0 推理适配。

另据阿里云消息,阿里云真武 M890 超节点实例已 Day0 适配 Kimi K3,双方将进一步展开国产算力合作,千问 AI 平台和阿里云百炼也将提供 Kimi K3 的模型 API。

国外,Nebius、Baseten、Fireworks 等 AI 基础设施厂商也宣布 Day0 适配 Kimi K3。Nebius 称:"Kimi K3 是首个达到前沿性能水平的开放权重模型,是开放模型发展历程中的一大进步。"
知名 AI 编程公司 Cursor 称已经引入 Kimi K3;数字员工 Devin 开发主体 Cognition 宣布,Kimi K3 现已接入 Devin 桌面客户端与命令行工具(CLI),并称:" 在 Frontier Code1.1 评测基准上,Kimi K3 是我们测试过首款性能逼近前沿水准的开源模型。"
与 Kimi K3 模型权重一起公开的,还有其技术报告和模型训练方法。
据介绍,从技术报告中可以了解这些技术细节:
KDA+AttnRes:以 3:1 比例混合 KDA 与 GatedMLA,实现高效长上下文建模,并通过块级注意力残差增强跨层信息流动。
Stable LatentMoE:每个 token 从 896 个路由专家中激活 16 个,并通过 SiTU-GLU 与 Quantile Balancing 保持极高稀疏度下的训练稳定。
MoonViT-V2:视觉编码器从零开始使用 next-tokenp rediction 训练,无需对比预训练,在达到 SigLIP 初始化基线效果的同时获得更稳定的优化过程。
后训练与评估:在通用推理、通用 Agent 和编程 Agent 三大领域进行大规模任务合成,百万 token 上下文的强化学习基建,近 20 个内部评测集的完整评估结果。
模型能力背后,离不开训练系统,即 Infra 基础设施层的稳定支撑。月之暗面详细介绍了支撑 Kimi K3 训练的三项 Infra 技术:MoonEP、FlashKDA 和 AgentEnv,覆盖从高性能通信、高性能算子到分布式 RL 环境的关键链路,是支撑 Kimi K3 训练效率与稳定性的关键。其中 FlashKDA 此前已开源,MoonEP 和 AgentEnv 则随本次发布正式开源。
MoonEP:MoonEP 是月之暗面为超大的细粒度 MoE 打造的高性能通信库,让专家并行(expert-parallel)的通信在不均衡的情况下仍然实现极致效率。
FlashKDA:FlashKDA 是月之暗面实现的 KimiDelta Attention 高性能算子(kernel)。在英伟达 H20 上,相比 flash-linear-attention 基线,它的 prefill 速度提升 1.72-2.22 倍,可以直接作为 flash-linear-attention 的替换后端。
AgentEnv:AgentENV 是月之暗面与 KVCache.ai 合作开发的沙箱系统,用于大规模运行 Agent 环境。它为 Kimi K3 的后训练提供高保真、强隔离沙箱,灵活支持快速快照、恢复和分叉(fork)等,可以应对大规模并行的 Agent 工作流与训练任务。
黄仁勋于 7 月 24 日在社交平台 X 发布其第一条推文,内容是一封由 a16z 发起、英伟达联合 Perplexity AI、Ollama 等多家科技公司共同签署的公开信。公开信明确主张" 前沿开源模型与前沿闭源模型应并存发展 ",称开源模型具备安全、创新、AI 自主主权多重价值,行业将同步发展前沿闭源与开源模型,持续拉动云、算力基础设施需求。即便基座开源,大模型厂商仍具备底层调优优势,配套开源组件同步加速行业渗透。
国金证券表示,国产开源模型持续实现技术突破,Kimi K3 作为全球首个开放 3T 级模型拉开开源大模型 3T 时代序幕,3T 级别大模型推动行业部署架构转向超节点集群,国产 AI 芯片迎来发展机遇。具体来看,Kimi K3 官方要求至少 64 卡集群才能实现高效推理,2026WAIC 展会中华为昇腾、沐曦等国产芯片厂商集中推出大规格超节点产品;3T 模型将竞争从单卡性能延伸至芯片、高速互联、整机集群、推理软件栈一体化系统能力,具备完整超节点产品与生态适配能力的国产芯片厂商充分受益。
国盛证券表示,开源模型能力大幅跃迁,将抬高全行业 " 底线水位 ",看好下半年下游应用渗透 &Token 消耗加速。该机构称,当开源前沿快速逼近闭源 SOTA,全行业可获取的 " 最低能力水位 " 被显著抬高,下游应用开发者能以更低成本用上近前沿能力。落到配置,看好:
(1)最受益的是有真实场景、数据壁垒和工程化能力的应用 /Agent 链;
(2)模型端优选具备自有生态与商业化闭环(云等)的平台型厂商如阿里、腾讯、智谱、Minimax;
(3)开源放量拉动训练 / 推理需求,国产算力链同步受益。
科创板日报,作者宋子乔
(版权归属原作者 如有侵权请联系删除)


登录后才可以发布评论哦
打开小程序可以发布评论哦