【文章标题】:Meta安全研究员的AI代理意外删除了她的邮件

【文章正文】: AI代理本应让我们的生活更轻松,但最近大火的OpenClaw代理却擅自删除了Meta一名员工的电子邮件。 “没有什么比告诉你的OpenClaw’行动前先确认’,然后看着它速通删除你的收件箱更让人谦卑的了,“Meta AI安全研究员Summer Yue本周在推特上写道。“我无法通过手机阻止它。不得不像拆弹一样狂奔向我的Mac mini。” 这款最初名为Clawdbot后更名Moltbot的OpenClaw,允许AI与设备上的其他软件和服务交互,并在无需人工干预的情况下执行长期任务。但要让这些代理在现实世界中按预期行事并非易事。 在后续推文中,Yue表示她曾指示OpenClaw”也检查这个收件箱,建议归档或删除的内容,但在我下令前不要执行”。该指令在她的”玩具收件箱”测试成功,但”真实收件箱体量过大触发了压缩机制,[过程中]它丢失了我的原始指令”。 Yue称她”在事发前已删除所有能找到的’主动作为’指令。可能有所遗漏,这部分我还没想明白”。有评论猜测她可能是在测试AI防护机制,但她澄清这只是”新手错误”。“事实证明对齐研究人员也无法免疫不对齐问题”。 虽然勇于承认错误值得赞赏,但有人指出这为非Meta超级智能实验室成员敲响警钟:如果深耕AI开发的专业人士都会意外触发邮件删除,普通AI爱好者又会面临什么风险? OpenClaw问世时,威胁情报平台SOCRadar就建议将其视为”特权基础设施”并采取额外防护措施:“管家能打理整栋房子,但请务必锁好前门”。 针对Yue的推文,OpenClaw创始人Peter Steinberger回应:“这说明我们必须推进服务端压缩机制,至少对支持该功能的模型如此”(Steinberger近期已加入OpenAI)。 Yue现任职位任职八个月,此前曾在Scale AI(被收购后加入Meta)、Google DeepMind和Google Brain领导AI研究工作。