假如给一台始终在线的电脑配上邮箱、电话号码以及支付功能,它会演化成什么形态?
9月28日发布的Manus 2.0正试图解答这个疑问。
昨晚,Manus团队宣布产品升级至2.0版本。此次更新不仅涵盖一个新版本,Manus还重新构建了智能体执行任务的底层架构,推出了可长期运行的云电脑与基于事件触发的自动化流程,并将桌面应用升级为涵盖办公、视频和游戏制作的Manus Studio;与此同时,发布了独立应用Cue,让用户能够创建具备各自身份的个人智能体。
Manus创始人肖弘在x上发文称:“我们回来了。”
Manus推出2.0版及个人智能体Cue
Manus 2.0已在网页、桌面和移动端上线;Cue已开放网页、桌面及部分移动端的邀请制抢先体验;iOS应用仍在等待App Store审核。
将这些功能综合来看,Manus想要解决的问题已超越“让AI根据指令完成一次任务”。一个能持续替用户办事的智能体,需要知晓何时启动、在何处运行、如何与人共同修改成果,以及怎样联系外部服务和其他人。
这也让Manus 2.0与Meta本月推出的个人智能体Muse,站到了相似的赛道上。
两者都为智能体提供了云端运行环境,并希望它能跨越聊天窗口、真正采取行动。但Manus这次提出了一个更具体的产品设想:用户未来拥有的,或许不只是一个助手,而是几个能分工、能被联系、各自拥有工作环境的智能体。
先换底座:一项任务不必携带全部工具
Manus 2.0的底层更新名为Cascade,是其自研智能体框架的新一轮迭代。据官方介绍,Cascade会让项目从轻量状态起步,仅在任务需要时引入相应的专业能力。一个项目里生成的简报、页面、视频和自动化流程,也能保持关联,而非各自成为孤立的任务结果。
Manus提供了一组测试数据:在一项测试配置中,Cascade相比此前系统,Token消耗减少23.2%,任务完成时间缩短28.2%,运行成本降低32%。这些是公司在特定配置下得到的结果,目前不能直接推断所有用户、所有任务都能获得相同比例的改善。
但其设计意图很明显:随着工具和能力越来越多,智能体不能每次执行任务都把整套能力装进上下文,否则响应时间和运行费用也会随之增加。
第二项底层能力是云电脑。过去,智能体可以替用户生成一个网站或游戏,但如果项目需要持续在线的服务器,任务就会延伸到托管和运维。
Manus现在允许用户为有需要的项目购买专属云端运行环境。官方举的例子包括多人联机游戏背后的服务器,以及长期运行的自动化流程。换句话说,AI完成制作后,还能有一个地方继续运行它做出来的东西。
第三项更新是Automations。此前的定时任务,要等预设时间到了才开始;现在,已连接服务中发生的事件也可以启动工作。
例如收到新邮件、广告数据出现波动、日历有新事件,或Slack、Notion中发生更新,都能成为触发条件。用户用自然语言说明需要关注什么、发生后做什么,Manus宣称可以据此搭建并运行相应流程。
这三项更新连起来,改变的是任务的生命周期:智能体可以按需调用能力,由外部事件唤醒,在云端环境里持续执行。它不再只能等待用户打开对话框、重新下一次命令。
Manus Studio:AI交出初稿,人还能接着改
如果说Cascade和云电脑决定智能体怎样工作,Manus Studio处理的则是人如何接手它的成果。Manus将桌面应用升级为人与AI共享的工作空间,覆盖文档、表格、PDF、幻灯片,以及网站、代码、视频和游戏。其中,新推出的视频编辑器与游戏开发环境,是这次更新中最明显的创作能力扩展。
视频编辑器强调“可改”。
在Manus的产品描述中,AI可以先制作初剪,但视频片段、图片、文字、动态图形和音频会以独立素材呈现在时间线上。
用户能够更换配乐、替换自己的图片、移动动画,再导出成片,也可以把修改后的项目交还给Manus,让它在已有改动上继续制作。其目标场景包括30至60秒的产品广告、数据动态图表、教程、Vlog和以动效为主的视频。
编辑器还提供Alchemy模式。与直接给出明确剪辑要求不同,用户可以先提供创意方向,再由Manus参与创意设计,同时调用视频生成和代码生成能力,之后仍可回到时间线进行精修。这里需要区分两件事:Alchemy模式确实会调用视频生成能力。
而肖弘在发布后的发文中提到,Cue相关视频采用的是由智能体编写代码、再转换为视频的方式,没有使用视频生成模型。两者描述的是不同的制作路径,不能混为一谈。
游戏开发环境则试图把“生成一个能玩的原型”继续推进到修改和发布。
Manus称,该环境可结合视频、图像和编程模型工作;用户能够在编辑面板中一边查看游戏运行效果,一边管理素材、修改代码,调整角色动作、美术和场景。做好后,可以将游戏作为网站发布,也可以借助云电脑提供持续在线的服务器,邀请朋友加入联机游戏。官方列出的支持场景包括竞速、对战、竞技和3D游戏。
Manus Studio还有一项容易被视频和游戏能力盖过的更新:远程控制与Computer Use。按照官方说明,用户可以在手机上向Manus提出要求,让它在已连接、已授权的电脑会话中寻找文件、导出PDF或测试应用,同时查看其桌面操作。
Manus称,智能体会在独立且可见的工作区中操作,并仅使用用户批准的文件、浏览器和应用。
这里形成了两种“电脑”:一种是智能体项目使用的云电脑,负责持续在线的运行任务;另一种是用户授权的本地电脑工作区,负责处理原本就在用户设备上的文件和应用。
Cue:给每个Agent一个外联身份
Manus 2.0最具争议空间、也最有想象力的部分,是同时发布的独立应用Cue。
根据官方介绍,Cue与Manus使用同一套基础设施,但面向个人智能体场景。
在Cue中,每个智能体都有自己的邮箱、电话号码、钱包和电脑。它可以发送消息、在用户设定的预算内付款,在自己的电脑上完成任务;也能替用户接听电话,并留下通话摘要。用户还可以把几个智能体放进同一个群聊:一个查找活动场地,一个整理候选名单,另一个起草演示文稿,最后由人决定方向与结果。
其中最关键的变化是“身份”。以前,智能体多半借用用户的账号、在用户打开的应用里完成一项操作;Cue希望让每个智能体成为可被单独联系的对象。
它有电话号码,意味着电话可以打给它;它有邮箱,意味着工作可以发给它;它有钱包和电脑,意味着它有一定范围内的执行资源。这些设计并不意味着智能体拥有人的法律地位,却让它在产品交互中越来越像一个受人委托、能够持续参与事务的角色。
Cue目前以邀请码形式开放,限时免费体验。
有抢先体验的用户在x上分享了注册流程和收费细节。有意思的是,Cue手机端还新增了一个为Agent注册手机号码的环节,其中一个美国电话号码每月0.99美元;而云端电脑Linux版本则每月39美元起步。
不过据最新用户反馈显示,目前0.99美元/月的档位已经被抢完,价格已经来到了9.99美元/月。当然,比收费更值得关注的是,这或将为移动端的Agent交互方式引入新玩法。
有网友推断,一个无法发送短信的电话号码,与其说是手机身份标识,不如说是Agent的语音外壳。所以,账号取消后,这个为Agent设置的号码还能保留吗?
免费版的配额每七天重置一次,看起来要体验完整功能仍然需要充值,而且并不便宜。
Cue与Muse:都设云端电脑,重点却不同
有意思的是,Cue发布前三周,Meta推出了Muse。从Muse和Manus两款产品的名字来看,它们太像了!
Muse也被定位为个人智能体:能在专属云端虚拟机中运行,配有浏览器,可以连接用户常用的应用,发送邮件、预订行程、填写表单或处理购物任务。用户关闭应用后,它仍可继续工作,Meta还希望它记住用户的目标和偏好,主动提出建议。
Cue和Muse都试图跨过从“回答”到“办事”的门槛,也都认为智能体需要一台云端电脑。
但目前公开的产品描述显示出不同重点:Muse围绕一个持续了解用户的个人代理展开,强调跨应用办事、长期目标和主动建议;Cue则强调多个拥有各自身份的智能体,让它们通过邮箱、电话和群聊参与分工。这是产品路线上的比较,尚不是对完成率或体验优劣的判断。
当智能体开始付款、发邮件、接电话,两条路线也会碰到同一个难题:用户到底授予了它多大的权力?
Meta在Muse的发布资料中说明,用户可以选择连接哪些应用及授予多少权限;发送邮件、购物等敏感操作需要确认,并提供操作记录。Cue则提出了预算内付款、独立通信身份和多智能体群聊。这些功能越接近真实交易,用户越需要知道哪一步由AI自行完成、哪一步需要人批准,以及出错后如何追溯。
2.0版本发布之时,肖弘也在微信朋友圈发文表示,Manus正积极筹备国内版本,也提到海外开放生态更容易构建产品体验。他写道:“Manus的诞生早于Codex和Claude Cowork,Manus一直是通用智能体。自己原本以为Manus的旅程可能只会成为行业发展中的一个注释,但现在或许有机会参与书写一个完整章节。”
对个人智能体来说,生态并不是一个抽象概念。一个能写计划、做视频的AI,可以主要依靠自身工具完成工作;一个要替人订餐、打电话、付款的AI,必须与外部商家、通信和支付服务真正接上。它的能力边界,很大程度上由这些连接决定。
Manus 2.0因而包含两层产品主张:Manus Studio让人和AI一起完成并修改作品,Cue则让AI带着自己的身份去参与后续事务。前者要证明智能体交出的成果经得起编辑;后者要证明智能体走出聊天框后,仍然能准确理解授权、可靠地替人办事。
新版本的功能已经列得足够丰富。接下来真正决定它能走多远的,是一个更朴素的问题:当用户把电脑、联系方式和一部分付款权交给AI,它能否把事情办成,也让用户始终知道事情是怎么办成的。
下一道门槛:外界愿不愿意与AI打交道
个人智能体还面临一个容易被产品演示掩盖的问题:它办事时总要遇到别人。餐厅是否接受智能体代为点餐?商家是否愿意和它沟通报价?收到邮件或电话的人,能否清楚知道对面是AI、它受谁委托、能够承诺什么?
Cue展示的扫码点餐、排队取号和智能体群聊,实际上把这道问题推到了产品前台。拥有邮箱和电话,意味着智能体能够进入既有的通信网络;但能进入网络,不等于周围的服务和其他人已经准备好与它协作。肖弘所说海外开放生态更容易形成产品体验,以及Manus正积极筹备国内版本,也与这一点有关。国内版本能否成立,除了智能体本身的能力,还取决于它可以连接哪些服务、如何获得授权,以及交易和通信环节如何衔接。
几乎在Manus发布2.0的同一天,Meta又宣布成立企业平台业务,计划将Muse、商业智能体、Muse API和编程工具提供给企业及开发者。这说明Meta也在尝试让个人智能体的能力走出单一消费应用,进入更多由企业提供的服务流程。
Manus 2.0与Cue的发布,因此可以从两个层面理解。一个是产品升级:更灵活的任务框架、更持久的运行环境,以及覆盖视频和游戏的创作工具。另一个是更大的试探:当智能体拥有电脑、联系方式和付款能力后,它能否成为一个被外界识别、能够受托办事的参与者?
目前,Cue还处于早期体验阶段,Muse也仍在扩展产品与服务。谁能完成更多任务,短期内会不断变化。
更难、也更能决定个人智能体能走多远的问题是:当AI开始替你开口、替你付款时,你和与它打交道的人,能否始终弄清它获得了什么授权、做了什么决定。