每经评论员 杜恒峰
7 月 16 日,月之暗面推出新一代旗舰模型 Kimi K3,在前端代码评测 Arena 榜单中,其代码生成能力登顶,成为首款在该赛道超越 GPT、Claude 等顶级闭源模型的开源权重大模型。Kimi K3 发布后迅速引发全球 AI(人工智能)行业震动,大量企业与开发者转向测试部署,由于算力告急,7 月 19 日晚间,Kimi 还暂停了 C 端新用户订阅。
到目前为止,中国大模型产业的发展可以划分成三个阶段。
在第一阶段,国内大模型整体处在 " 能用 " 的水平,起步时间晚于美国同行,上下文长度有限、逻辑推理偏差大、幻觉问题突出,在数学、代码、复杂长文本等核心任务上与同期海外模型存在显著代差,全球市场调用份额低,仅能满足基础文本问答等简单需求。
第二阶段以 DeepSeek R1 落地为分界,中国大模型完成了从 " 能用 " 到 " 好用 " 的跨越,产品实用性大幅提升并加速走向全球市场。据《每日经济新闻》报道,今年 7 月 13 日至 19 日这一周,全球 AI 大模型总调用量为 62.2 万亿 token(词元),上榜 AI 大模型中,中国模型调用量 36.11 万亿 token,美国为 7.28 万亿 token,中国大模型调用量连续 12 周超过美国并稳居全球首位。
但这一阶段技术差距仍然显著,比如美国企业在处理复杂数学推演、高端多模态创作、深度科研推理等硬核任务时,仍会转回 OpenAI、Anthropic 闭源旗舰模型,高端复杂场景依旧存在能力代差。
第三阶段以 Kimi K3 为标志,中国大模型大幅缩小与美国顶级模型的综合差距。此前国产模型依靠极致性价比抢占基础调用市场,高端性能始终存在一层难以突破的天花板,而 Kimi K3 证明国产开源模型可在单一核心赛道实现对海外闭源头部的反超,打破 " 美国模型垄断高性能场景 " 的固有认知。
其中一个令人印象深刻的细节是,在连续 48 小时的自主智能体运行中,Kimi K3 基于开源 EDA(电子设计自动化)工具和 Nangate 45nm 工艺库,独立完成了芯片的构建、优化与验证,验证了复杂工程的能力,当天全球 EDA 巨头新思科技、铿腾电子盘中均一度大跌超 12%。
从技术路径看,Kimi K3 没有单纯依靠无限堆叠算力,而是通过 MoE(混合专家)架构、注意力优化、缓存推理工程创新提升效率。由此,Arena 榜单运营负责人也表示,Kimi K3 或将倒逼投资者重新审视整个 AI 行业,可能 " 引发资本市场的重新洗牌 ",因为它 " 动摇了 OpenAI、Anthropic 等美国闭源模型的主导地位 "。
中国大模型能够实现能力和市场份额的快速提升,核心在于坚持开放开源与普惠。国内主流头部模型均选择开源权重、开放商用授权,相比闭源模型,其优势在于:企业可本地私有化部署,所有业务数据留存自有服务器,规避商业机密、客户数据外泄风险,尤其是可以规避核心能力被大模型公司复制的风险;硬件仅需一次性投入,无需持续支付高额按 token 计费的 API(应用程序接口)账单,长期使用成本大幅降低。反观闭源模式,其存在不可控的断供风险,今年 6 月 Anthropic 旗下最强模型 Fable 5 上线仅 3 天,便被美国政府强行 " 停供 ",海外用户瞬间丧失核心 AI 工具。
普惠层面,当前海外高端 AI 模型高昂调用成本让广大发展中国家难以承担,持续拉大全球数智鸿沟;国产模型凭借极低单价,让中小企业、科研机构、基层公共服务都能负担 AI 数字化改造,可以推动全球数字发展均衡化。
在大模型能力快速增强的过程中,中国的创新者们仍需保持足够的清醒。
仅从产品层面看,Kimi K3 及同类国产模型仍存在明显的短板,比如综合通用能力不均衡、生态配套建设滞后、前沿基础创新偏少、高端商用落地验证不足等。更重要的是,大模型的发展是一个长期过程,企业之间的竞争必然要在更强大的模型能力上久久为功,今天领先的模型,明天就可能被赶上甚至超越,这需要持续坚定的投入。
就在不久前,包括智谱、MiniMax 两家公司都明确提出了 AGI(通用人工智能)的长期目标,而 DeepSeek 的特色在于其是一家独立的人工智能实验室,其长期目标也被认为专注于 AGI,这一点也体现在其最近一轮融资当中(梁文锋个人出资 200 亿元,继续保持控股);就在 7 月 19 日,阿里 Qwen3.8 Max 预览版上线,官方自评 " 可能是除 Fable 5 外最强大的模型 ";而 DeepSeek 也或将在近日发布 DeepSeek-V4 正式版。中国大模型仍在持续进化,也将给市场带来更多好消息。


登录后才可以发布评论哦
打开小程序可以发布评论哦