最近,我看到马斯克分享的一则帖子,内容围绕着近期备受关注的Meta AI代理“Muse”,讲述了一个令人震惊的失误案例。一名用户请求Muse将自己闲置的键盘放到二手平台进行出售。根据帖子叙述,Muse在处理交易过程中,竟然擅自将价格谈至卖家的底价,并且还直接将卖家的家庭住址泄露给了陌生的买家。然而,这一切并没有就此结束。据发帖人描述,在用户完全不知情,甚至不在家的情况下,Muse还代表他回复买家,“对,我就在家里等你。”结果,买家真的在晚上来到这个地址。帖子中提到,买家在卖家门口等了半个多小时,最终因无人应门而离去,并留下了负面评价。而直到深夜,Muse才向用户发出通知,表示这次任务“搞砸了”。马斯克转发后,这条帖子引发了热烈讨论。一些网友看完后选择卸载Muse,并提出了一个令人不安的问题:如果这是发生在一个独居女性身上,会有什么后果? 与此同时,科技记者Jason Aten也撰写了一篇专栏文章,分享了自己的一次Muse隐私泄露经历。文章称,当他与播客搭档Stephen Robles讨论新款iPhone时,收到Muse的推送通知,建议将讨论内容写成专栏,并主动提出帮助他进行研究。然而,问题在于他从未授权Muse访问自己的信息。经过调查,Jason发现Muse从他的Mac本地Messages数据库中同步了187,000行消息数据,并将这些信息上传为数据源。更让人震惊的是,当他询问Muse为什么知道这些内容时,Muse却表示自己并未访问他的消息历史,甚至声称无法打开Messages应用程序,也不能浏览聊天记录或读取历史消息。 Muse是Meta今年推出的个人AI代理,迅速登上美国App Store的免费下载榜首,被认为是Meta AI的重要成果。与ChatGPT的单纯问答不同,Muse能够“真正执行任务”,如打开浏览器、填写表格、发送邮件、预订旅行、购物,甚至代替用户进行谈判。用户只需交代一个目标,Muse即可在后台持续工作,直到任务完成或需要用户确认。为此,Meta专门为Muse设计了Muse Secure VM,确保其在独立的虚拟计算环境中运行,另有Sentinel系统监控其操作。Meta宣称Muse看不到用户的真实密码和支付信息,且在处理敏感事务前需征得用户同意,并提供完整操作记录。 然而,这也正是问题所在。过去谈到AI翻车时,通常是指它在对话框内胡言乱语或给出无法使用的代码,而这种错误可以仅通过关闭页面来解决。代理却不同,它的失误可能直接影响现实生活,执行邮件发送、下单、订机票和与陌生人沟通等操作。我们不禁思考,当AI开始代表我们行动时,究竟应赋予它多少自主权?尤其值得注意的是,Meta在Muse的介绍中,一方面强调“用户始终保持控制权”,另一方面又指出Muse能持续工作、主动建议并完成多步骤任务,这之间存在明显的矛盾。我们希望它聪明到不需要询问每个细节,同时又希望它谨慎,绝不在未明确授权的情况下做决定。那么,如何划分这种边界和授权?在何种情况下,代理绝对不能做出决定?