Manus 2.0发布Cue 打造独立身份智能体

当人工智能体拥有一台持续在线的云主机,再配备专属邮箱、联系号码和付款权限时,它能演化成怎样的形态?9月28日正式推出的Manus 2.0,正是对这个问题的尝试性解答。
本次更新不止于版本迭代,团队对智能体执行任务的底层逻辑进行了全面重构:推出了可长期稳定运行的云端运行环境,新增了基于外部事件触发的自动化工作流,还将原有桌面应用升级为覆盖办公、视频创作、游戏开发的Manus Studio;同时独立发布了Cue应用,帮助用户创建拥有独立身份的个人智能体。Manus创始人肖弘在海外社交平台上发文称:“我们回来了。”
目前Manus 2.0已覆盖网页端、桌面端和移动端;Cue则开启了网页端、桌面端及部分移动端的邀请制抢先体验,iOS版本仍在等待应用商店审核。
将这些功能放在一起看,Manus想要解决的问题已经超出了“让AI根据指令完成单次任务”的范畴。一个能持续替用户办事的智能体,需要知道何时开工、在哪里运行、怎样与人共同修改成果,以及如何联系外部服务和其他人。
此次更新也让Manus 2.0和Meta本月推出的个人智能体Muse进入了相近的赛道。两款产品都为智能体配备了云端运行环境,都希望让AI跳出聊天窗口,真正执行实际任务。不过Manus提出了更具象的产品愿景:未来用户拥有的或许不只是一个单一助手,而是多个可以分工协作、能够被独立联系、各自拥有专属工作环境的智能体。
轻量化底层框架:按需调用能力降低成本
Manus 2.0的底层更新名为Cascade,是团队自研智能体框架的又一次迭代。据官方介绍,Cascade会让项目从轻量化状态启动,仅在任务需要时才调用对应的专业能力,同时让同一个项目中的简报、页面、视频和自动化流程保持关联,避免出现孤立的任务结果。
团队给出的测试数据显示,在特定配置下,Cascade相比旧系统,Token消耗减少23.2%,任务完成时间缩短28.2%,运行成本降低32%。不过官方也提醒,这是特定测试环境下的结果,不能直接推广到所有用户和任务场景。
这一设计的核心意图很明确:随着智能体可用工具和能力的不断丰富,不能让它在每次执行任务时都加载全套能力,否则会导致响应变慢、运行成本上升。
第二项核心底层能力是专属云电脑。此前智能体可以帮用户生成网站或游戏原型,但如果项目需要持续在线的服务器,就需要额外的托管和运维工作。现在Manus允许用户为有需求的项目购买专属云端运行环境,官方举例包括多人联机游戏的后端服务器,以及长期运行的自动化工作流——也就是说,AI完成创作后,还能有稳定的环境持续运行它生成的成果。
第三项更新是Automations功能。此前的自动化任务只能等待预设时间启动,现在可以由已连接服务中的外部事件触发,比如收到新邮件、广告数据出现波动、日历新增事件,或是Slack、Notion平台发生更新等。用户只需用自然语言说明需要监控的条件和触发后的操作,Manus就能据此搭建并运行对应的自动化流程。
这三项更新共同改变了智能体的任务生命周期:它可以根据需求调用能力,由外部事件主动唤醒,并在云端环境中持续执行任务,不再只能等待用户打开对话窗口、重新下达指令。
Manus Studio:人与AI协作的创作空间
如果说Cascade框架和云电脑决定了智能体的运行方式,那么Manus Studio则解决了人类如何接手AI产出成果的问题。团队将原有桌面应用升级为人与AI共享的协作工作区,覆盖文档、表格、PDF、演示文稿、网站、代码、视频和游戏创作等多个场景,其中新增的视频编辑器和游戏开发环境是本次更新中最亮眼的创作能力扩展。
视频编辑器主打“可编辑性”。根据产品说明,AI可以先生成初剪版本,此时视频片段、图片、文字、动态图形和音频都会作为独立素材显示在时间轴上。用户可以自由更换配乐、替换自有图片、调整动画效果,完成初步修改后导出成品,也可以将修改后的项目交还给Manus,让AI在现有改动的基础上继续优化。该工具的目标场景包括30至60秒的产品广告、数据动态可视化图表、教程视频、Vlog以及以动效为主的创作内容。
编辑器还提供Alchemy模式,和直接给出明确剪辑要求不同,用户可以先提供大致的创意方向,由Manus参与创意设计,同时调用视频生成和代码生成能力,之后用户仍可以回到时间轴进行精细化修改。这里需要注意区分两种制作路径:Alchemy模式确实会调用视频生成模型,而肖弘在后续发文提到,Cue相关视频采用的是智能体编写代码再转换为视频的方式,并未使用视频生成模型,两者属于不同的创作流程,不能混淆。
游戏开发环境则将AI创作的范围从生成原型拓展到修改和发布环节。Manus表示,该环境可以结合视频、图像和编程模型工作,用户可以在编辑面板中一边查看游戏的实时运行效果,一边管理素材、修改代码、调整角色动作、美术风格和场景设置。完成开发后,既可以将游戏作为网站发布,也可以借助云电脑提供的持续在线服务器邀请好友加入联机对局,官方列出的支持场景包括竞速类、对战类、竞技类和3D游戏。
Manus Studio还有一项容易被视频和游戏能力掩盖的更新:远程控制与Computer Use功能。根据官方说明,用户可以在手机端向Manus提出需求,让它在已连接并获得授权的电脑会话中查找文件、导出PDF或测试应用,同时用户可以查看桌面操作过程。Manus强调,智能体会在独立且可见的工作区中执行操作,且仅使用用户预先批准的文件、浏览器和应用程序。
这一功能也形成了两种“电脑”形态:一种是智能体项目使用的云电脑,负责持续在线的运行任务;另一种是用户授权的本地电脑工作区,用于处理原本就存储在用户设备上的文件和应用。
Cue:赋予智能体独立身份
Manus 2.0中最具想象空间也最受关注的更新,是同步发布的独立应用Cue。据官方介绍,Cue和Manus使用同一套底层基础设施,但专门面向个人智能体场景打造。
在Cue中,每个智能体都拥有专属的邮箱、联系号码、钱包和电脑环境:它可以发送消息、在用户设定的预算内完成付款、在自有电脑环境中执行任务,还能替用户接听电话并整理通话摘要。用户还可以将多个智能体加入同一个群聊,比如让一个智能体负责查找活动场地,另一个整理候选名单,还有一个起草演示文稿,最终由用户决定整体方向和最终结果。
Cue最关键的设计变化在于“身份”。此前的智能体大多借用用户的账号,在用户打开的应用中完成单次操作;而Cue希望让每个智能体成为可以被独立联系的对象。它拥有专属电话号码,意味着其他人可以直接致电联系;拥有专属邮箱,意味着工作需求可以直接发送给它;配备钱包和电脑环境,则意味着它拥有一定范围内的执行资源。这些设计并不意味着智能体拥有人类的法律地位,但让它在产品交互中越来越像一个受人委托、能够持续参与事务的独立角色。
目前Cue采用邀请码形式开放,限时提供免费体验。有抢先体验的用户在海外社交平台上分享了注册流程和收费细节,其中一个值得注意的点是,Cue的手机端新增了为智能体注册专属手机号码的环节:美国地区的号码每月费用为0.99美元,Linux版本的云端电脑则每月39美元起。不过根据最新的用户反馈,0.99美元每月的档位已经售罄,当前价格已经调整为9.99美元每月。
值得关注的是,这一设计或许会为移动端的智能体交互方式带来全新的玩法。免费版本的使用配额每七天重置一次,看起来用户如果想要体验完整功能,仍然需要进行充值,且费用并不低廉。有网友提出疑问:一个无法发送短信的电话号码,与其说是手机身份标识,不如说是智能体的语音交互外壳,那么在账号绑定后,这个为智能体设置的号码是否可以长期保留?
与Muse的赛道差异
有意思的是,在Cue发布的三周前,Meta推出了个人智能体Muse,两款产品的名字也颇为相似。Muse同样被定位为个人智能体:它可以在专属云端虚拟机中运行,配备浏览器功能,可以连接用户常用的应用程序,完成发送邮件、预订行程、填写表单或处理购物订单等任务。即使用户关闭应用,Muse仍可以继续工作,Meta还希望它能够记住用户的目标和偏好,主动为用户提供建议。
Cue和Muse都试图跨越“回答问题”到“实际办事”的门槛,也都认为智能体需要专属的云端电脑环境。但从目前公开的产品描述来看,两者的侧重点有所不同:Muse围绕一个持续了解用户的单一代理展开,强调跨应用办事、长期目标跟踪和主动建议;而Cue则更侧重多个拥有独立身份的智能体,通过邮箱、电话和群聊实现分工协作。这只是两款产品在路线上的差异,目前还无法判断哪一款的完成度或用户体验更优。
当智能体开始具备付款、发邮件、接电话的能力时,两款产品都会遇到同一个核心问题:用户到底授予了它多大的操作权限?Meta在Muse的发布资料中说明,用户可以自主选择连接哪些应用以及授予对应的权限,发送邮件、购物等敏感操作需要经过用户确认,并会提供完整的操作记录。而Cue则主打预算内付款、独立通信身份和多智能体群聊功能。随着这些功能越来越接近真实的交易场景,用户越需要明确知道哪一步操作由AI自主完成,哪一步需要人工批准,以及出现错误后该如何追溯责任。
在Manus 2.0发布之际,肖弘在微信朋友圈发文表示,团队正在积极筹备国内版本,同时提到海外开放的生态环境更容易构建完整的产品体验。他写道:“Manus的诞生早于Codex和Claude Cowork,Manus一直是通用智能体。我原本以为Manus的发展历程可能只会成为行业发展中的一个注脚,但现在或许有机会参与书写一个完整的行业章节。”
对于个人智能体来说,生态并不是一个抽象的概念。一个能够撰写计划、制作视频的AI,可以主要依靠自身工具完成工作;但一个需要替人订餐、打电话、付款的AI,必须真正接入外部商家、通信和支付服务。智能体的能力边界,很大程度上由这些外部连接的丰富程度决定。
Manus 2.0包含两层核心产品主张:Manus Studio让人类和AI共同完成并修改创作成果,证明智能体产出的作品可以经得起人工编辑;而Cue则让AI带着独立身份参与后续事务,证明智能体跳出聊天窗口后,依然能够准确理解授权规则、可靠地替用户完成任务。
新版本的功能已经足够丰富,但真正决定它能走多远的,是一个朴素的核心问题:当用户将自己的电脑、联系方式和一部分付款权限交给AI时,它能否顺利完成任务,同时让用户始终清楚了解任务的完成过程。
下一道门槛:外界愿不愿意与AI打交道
个人智能体还面临一个容易被产品演示掩盖的现实问题:它在办事过程中必然会接触到其他人和机构。比如餐厅是否接受智能体代为点餐?商家是否愿意和智能体沟通报价?收到智能体发来的邮件或电话的人,能否清楚知道对面是AI、它受谁委托、能够做出何种承诺?
Cue展示的扫码点餐、排队取号和多智能体群聊功能,实际上将这个问题推到了产品前台。智能体拥有邮箱和电话,意味着它能够进入现有的通信网络,但能够接入网络并不意味着周围的服务和其他用户已经准备好与它协作。肖弘提到的海外开放生态更容易形成产品体验,以及团队正在筹备的国内版本,都和这一点密切相关。国内版本能否顺利落地,除了智能体本身的能力外,还取决于它可以接入哪些服务、如何获得合法授权,以及交易和通信环节如何顺畅衔接。
几乎在Manus发布2.0版本的同一天,Meta宣布成立企业平台业务,计划将Muse、商业智能体、Muse API和编程工具提供给企业和开发者。这说明Meta也在尝试让个人智能体的能力跳出单一消费应用,进入更多由企业提供的服务流程中。
因此,Manus 2.0和Cue的发布可以从两个层面来理解:一方面是产品层面的升级,包括更灵活的任务框架、更持久的运行环境,以及覆盖视频和游戏创作的工具;另一方面则是行业层面的试探:当智能体拥有专属电脑、联系方式和付款能力后,它能否成为一个可以被外界识别、能够受托办事的独立参与者?
目前Cue仍处于早期体验阶段,Muse也还在不断扩展产品和服务,哪一款产品能够完成更多任务,在短期内还会不断变化。但更难也更能决定个人智能体能走多远的问题是:当AI开始替你开口说话、替你完成付款时,你和与它打交道的人,能否始终清楚了解它获得了哪些授权、做出了哪些决定。

