文章摘要
面向真实工作场景的小米MiMo Desktop桌面AI客户端开启新一代模型预览邀测,审核通过的受邀用户可限时免费体验两款全新预览版模型。该客户端支持多素材兼容、实时交互预览、局部精准编辑,具备智能任务调度能力,优化了长任务成本,目前开放邀测申请,优先面向平台已有用户开放。

一款面向真实工作场景的桌面AI客户端正式开启新一代模型的预览邀测,受邀用户可在限定时间内免费体验两款全新预览版模型。

全场景素材兼容,一站式交付可编辑成果

这款客户端支持直接读取多格式素材,无需用户提前整理或转换格式,无论是表格、图片、视频、PDF、录音还是未解压的压缩包,都可以直接作为任务上下文。用户仅需用自然语言说明目标,客户端就能自动理解素材、拆解任务、调用工具执行,最终交付可继续编辑的成果,涵盖文档、表格、幻灯片、网页、图片、音频、视频,甚至3D模型、应用程序或软件工程项目。

比如制作PPT的完整流程:从混合素材输入开始,经过事实与数据梳理、叙事结构设计、图表与版式生成,最终交付可直接修改的PPT文件;再如设计工作流,用户输入自然语言需求后,系统会理解任务、规划工作流、调用对应工具,实时生成设计元素并交付最终成果。

实时交互预览,无需额外搭建环境

这款客户端提供的成果预览并非静态截图,而是包含组件结构、交互逻辑、状态变化和数据可视化的完整页面,用户可以直接在会话中点击、操作并继续修改这些成果。无论是生成轻量游戏原型、复杂数据网页、办公文件还是需要动态交互的演示Demo,用户都可以立即预览成果、提出问题并继续迭代,无需提前搭建本地前端环境。

用户可以提出各类创意需求,比如生成带有动态灯光秀的3D交互式网页、制作越野卡车主题的足球游戏、设计带有地域风格的演示文稿,或是完成深度行业调研报告,系统都可以快速生成对应的高质量成果。

局部精准编辑,保留版本历史

任务交付并非会话的终点,用户可以直接选中会话或产物中的任意元素、文本段落、图表或表格区域,用自然语言描述下一步的工作或修改要求。系统会限定选区的作用范围,仅处理用户希望修改的部分,无需重新生成完整成果,也不必重复交代任务背景。每次修改都会保留版本记录,用户可以对比不同方案,也可以随时回退到历史版本。

比如在演示文稿中进行局部修改时,只需选中对应范围,描述修改意见,系统就会实时局部重生成对应的内容,高效且精准。

智能调度系统,自动匹配最优执行路径

用户无需在开始任务前自行判断选用哪个模型、哪个智能体或哪套执行框架,这款客户端内置了智能调度模式,可以自动评估任务类型、复杂程度、交付要求和执行成本,再自动匹配最适合当前任务的执行路径。

  • 任务评估:识别任务属于办公、编程、研究、设计还是混合场景,并判断所需的推理深度、工具范围和交付标准。
  • 模型路由:在标准模型与旗舰模型之间动态选择,日常任务优先选用速度快、成本低的标准模型,复杂推理、长链路执行和高质量交付则使用旗舰模型以保证产出质量。
  • 框架/智能体路由:根据任务类型选择办公、代码或研究类的执行框架,大型任务可以拆分给多个智能体,分别负责调研、规划、执行和复核,并在执行过程中自动调用不同技能以拓展能力、满足交付质量。
  • 多会话协同:用户可以按需组成多角色会话团队,各个会话之间可以自动相互通信、彼此协作,每个会话在推进项目的过程中,都拥有独立的记忆、工作区和任务状态。

这种智能调度模式可以最大化节省用户的心智负担,自动在质量、速度和成本之间做出最优选择。

浏览器双向赋能,作为信息与执行入口

这款客户端还可以自主控制电脑浏览器,读取浏览页面、执行交互操作,包括打开网页、检索信息、填写表单和提取素材。浏览器不再仅仅是信息来源,也作为任务执行环境的一部分,从浏览器中获得的信息可以直接进入当前任务,用于调研、分析、整理和内容制作,最大化节省用户自行检索和跨应用传递内容的时间。在生成网页类成果时,客户端也可以在同一工作流中用浏览器检查关键交互,自动验证成果的可用性。

优化长任务成本,提升使用经济性

长任务不仅需要高质量完成,更要控制计算成本。这款客户端通过模型路由、局部编辑和上下文缓存机制的优化,减少不必要的成本支出。智能调度模式会按照任务复杂度选择合适的模型,局部编辑仅处理需要重新生成的修改内容,高缓存命中优化则最大程度减少缓存部分的重复计算量。三种机制结合,分别降低模型选择、变更范围和重复上下文计算带来的Token消耗。在实际的长任务测试中,同会话的缓存命中率最高可达99%,跨会话最高可达95%,帮助用户最大化控制任务成本。

抢先体验新一代预览模型

在本次邀测期间,通过申请的用户可以限时、限量免费体验两款全新一代预览版模型,两款模型的代号分别为MiMo-X-Pro-Preview和MiMo-X-Flash-Preview。该系列模型面向真实专业工作场景优化,重点覆盖复杂任务推理、多智能体协作、大型编程项目、办公软件操作、网页设计、前端与交互设计、视频剪辑、3D生成、音乐生成、电脑操控等多个领域。目前该系列模型仍处于预览测试阶段,能力表现可能会随版本迭代发生变化,用户基于实际任务的反馈将用于后续的评估与改进。

参与邀测的方式

用户可以访问申请页面提交参与邀测的申请,审核通过后即可下载并使用这款桌面AI客户端。本次邀测将优先面向平台已有用户开放。

写在最后

我们相信,通用人工智能的意义不止于理解世界,更在于帮助每个人创造属于自己的成果。这款桌面AI客户端正是我们迈向真实工作流,帮助用户将想法转化为高质量成果的第一步。我们欢迎更多用户申请参与邀测,并用真实任务告诉我们:它已经能够完成什么,还有哪些地方需要改进。

以上内容不代表本平台立场,仅供读者参考