作者 | 赵芷姗
编辑 | 周伟鹏
9月 22 日,小米发布并开源新一代大模型 MiMo-V2.6,包含 Pro 版和 Flash 版。
Pro 版专攻复杂硬核任务,Flash 版主打平衡性能和推理成本。
同时,小米还推出 Pro 的超高速变体 UltraSpeed,在模型输出质量基本不变的前提下,最高可以把推理速度提升 20 倍,专门应对低延迟的实时调用场景。
在海外权威测评机构 Artificial Analysis 的综合智能指数上,MiMo-V2.6-Pro 拿到 46 分,一举超过Kimi K3、千问 3.8 Max,登顶全球开源模型第一、国产模型第一。

开源登顶
支持全模态
Pro 版总参数 1.02 万亿,激活参数 420 亿,面对大型软件工程开发、3D 空间推理、多模态复杂创作这类高难度工作,它能力更强。
Flash 版总参数 3090 亿,激活参数 150 亿,它的推理速度快、调用成本低,更适合中小企业、个人开发者。
两个版本都支持 100 万 Token 超长上下文,一次性可以读取 70 多万字的文本,整本长篇小说、整套项目文档都能完整消化。
除了综合智能外,它的代码能力同样亮眼。在模拟真实软件工程的 DeepSWE 测试里,新一代 V2.6-Pro 冲到 72.6 分,比上一代提升 14 分。

这个成绩,已经和海外顶级的闭源模型 Claude Opus 5(74 分)、GPT-5.6 Sol(73 分)站在同一梯队。
值得注意的是,Pro 版和 Flash 版都是原生全模态模型,文字、图片、视频、音频从训练阶段就共用一套底层模型。
根据官方的技术文档,用户给它一张草图,它就能生成三维建模,可用于 3D 打印。

输入图片、视频或文字后,它还会拆解任务,由智能体协作完成游戏 3D 场景的搭建,并根据渲染结果不断修正。

但比起性能,真正让同行头皮发麻的是价格。
Pro 版每百万 Token 输入 3 元,输出 6 元;Flash 版更狠,输入只要 1 元,输出 2 元。

这还是在智能大幅升级的前提下,价格跟上一代相比,一分没涨。
综合智能比它高 5 分的 Claude Opus 5,输入 5 美元(约合人民币 33 元),是它的 11 倍,输出 25 美元(167 元),更是贵了快 28 倍。
罗福莉公开直播
6 天烧掉2324万元
MiMo-V2.6 强大能力的背后,是小米巨大的烧钱实验。
9 月 17 日,小米大模型团队负责人罗福莉,把 MiMo-V2.6 强化学习训练的实时页面对外直播。
训练步数、Token 消耗量、任务通过率、累计花费,甚至哪个节点的显卡出了故障,全都实时可查。

有开发者盯着仪表板算过,半分钟费用涨了 287 美元,折算下来每秒约烧掉 8.5 美元,一小时 3 万美元(约合人民币 20 万元)。
这场直播在整个行业都是头一回,小米相当于直接把 " 电表 " 摆在所有人的面前,告诉大家:我们有钱,并且有信心,不怕被围观。
最终,这轮强化学习训练跑了不到 6 天,官方公布,Pro 版花了 262 万美元,Flash 版 85 万美元,合计 347 万美元,折合人民币约2324万元。
并且这些花费只是强化学习后训练的账单,不包括前面漫长昂贵的预训练。
结语
客观来说,MiMo-V2.6 虽然登顶开源榜单,但和 GPT-6 Astra、Claude Fable 5.1 这类顶级闭源模型相比,依旧存在差距。
不过,在这条路上,不是只有一家公司在冲刺。
不久前,DeepSeek V4 Flash 还因为便宜且能力强,被开发者看作是 AI 大模型斩杀线,现在 MiMo-V2.6 的推出,又重新划定斩杀线。
国产大模型开始轮番站到高处,一个比一个强,一个比一个便宜。
这早已不是单点突围,而是国产 AI 的集体向上。
赛道的竞争远未结束,斩杀线会不断被刷新,但这股国产 AI 持续突破的势头,才是最值得期待的变化。
•END •
欢迎点击科技每日推送视频号,看最新视频 ~
↓↓↓
Question. Write.Narrate. Believe. Become a story. 易简传媒的愿景是提问和传播商业故事,让读者更开阔,更聪明。有 2500 万微信粉丝关注我们的账号,欢迎大家关注:


