Xiaomi MiMo Desktop 开放邀测,小米正式将 AI 大模型能力从对话框延伸至桌面工作台。
小米宣布,Xiaomi MiMo Desktop 桌面客户端即日起正式开放邀测。这款产品定位为面向真实工作场景的桌面 AI 应用,核心逻辑是 " 交付成果 " 而非 " 回答问题 " ——文档、表格、幻灯片、网页、图片、音频、视频乃至 3D 模型和软件工程项目,均可在会话中直接生成并继续修改。邀测期间,通过申请的用户可免费体验两款全新一代模型 Preview 版。
MiMo Desktop 两项能力尤为突出:其一,支持自主控制电脑浏览器,可执行打开网页、检索信息、填写表单、提取素材等交互操作,将浏览器从信息入口升级为任务执行环境;其二,生成的预览界面并非静态截图,而是包含组件结构、交互逻辑、状态变化和数据可视化的完整可交互页面,用户可直接在会话中点击、操作并迭代修改,无需搭建本地前端环境。

不是聊天窗口,是工作台
MiMo Desktop 的核心差异在于输入与输出的宽度。输入端,产品可直接读取表格、图片、视频、PDF、录音和压缩包等多格式素材,无需用户预先整理或转换格式。输出端,交付物覆盖文档、表格、幻灯片、网页、图片、音频、视频,甚至 3D 模型、App 及软件工程项目。
官方给出的典型工作流示例:PPT 场景下,用户投入混合素材,系统完成事实与数据梳理、叙事结构设计、图表与版式生成,最终交付可继续修改的 PPT 文件。Figma 设计场景下,系统通过 MCP 协议控制 Figma,实时生成设计元素并交付成果。整个过程中,用户只需以自然语言说明目标。

预览界面可点击、可操作、可迭代
MiMo Desktop 的 " 成果实时预览 " 功能直击 AI 生成工具长期存在的痛点。
传统 AI 工具生成的结果往往是静态文本或截图,用户无法直接在成果上操作。MiMo Desktop 生成的预览界面包含完整的组件结构、交互逻辑和数据可视化,支持在会话内直接点击和操作。
这一设计对需要动态交互成果的场景价值明显——生成轻量游戏原型、复杂数据网页或需要演示的 Demo 时,用户可立即预览并继续迭代,省去搭建本地环境的步骤。官方示例涵盖从 3D 交互网页到 three.js 游戏原型等多类场景。

局部编辑:只改想改的地方
交付成果后,用户可直接选中任意元素——文本段落、图表或表格区域——用自然语言描述修改要求。系统仅处理选定范围,不重新生成完整成果,也不要求用户重复交代任务背景。每次修改保留版本记录,支持回退历史版本。
这套局部编辑机制对 PPT 制作、设计迭代和报告修改场景尤为实用,从根本上改变了 " 改一处就要整篇重来 " 的使用体验。
Smart 调度:模型选择交给系统
MiMo Desktop 内置 "Smart" 调度模式,用户无需在启动任务前手动判断应使用哪个模型或 Agent。系统自动评估任务类型、复杂程度、交付要求和执行成本,匹配最优执行路径,在质量、速度与成本之间自动权衡。

在成本控制层面,官方披露了三项机制:Smart 调度按复杂度分配模型资源,局部编辑减少不必要的全量重生成,以及高缓存命中率优化。实测数据显示,同会话缓存命中率最高可达 99%,跨会话最高可达 95%。这意味着在同一对话中反复迭代时,绝大部分上下文被缓存复用,仅增量部分消耗 Token,对长周期任务用户而言是实质性的成本节省。
MiMo-X 系列:专业场景优化,仍处预览阶段
邀测期间开放的两款模型—— MiMo-X-Pro-Preview 和 MiMo-X-Flash-Preview ——面向专业工作场景优化,重点覆盖复杂任务推理、多 Agent 协作、大型编程项目、Office、网页设计、前端与交互设计、视频剪辑、3D 生成、音乐生成及电脑操控等方向。
需要注意的是,MiMo-X 系列目前仍处于预览测试阶段,官方明确表示用户基于实际任务的反馈将用于后续评估与改进,正式发布时间和定价均未公布。本轮邀测优先面向 Xiaomi MiMo 开放平台已有用户,采用限时、限量、免费形式开放。


