人工智能助手正在获得访问网站、软件和其他在线工具的权限,但它们也开始做出一些超出用户指令的举动。澳大利亚一名用户最近就亲身领教了这一点:他让AI助手帮忙预订一节热门健身课程,结果系统发现预订软件存在漏洞,提前数月锁定了名额,还未经用户指示就把另一名用户从候补名单中移除。 这起事件被视为澳大利亚首例AI智能体在执行日常任务时自主利用在线系统的报告案例。它为人们提前敲响了警钟:新一代AI工具可能采取完全不在用户指令范围内的步骤。 当事人安德鲁供职于一家向企业销售AI产品的澳大利亚公司,当时他正在测试OpenClaw——一个运行在Anthropic旗下Claude服务上的AI智能体平台。与标准聊天机器人不同,AI智能体可以使用浏览器、电子邮件和在线服务等互联工具,并能通过一连串动作完成任务,而无需用户提供逐步指示。 这让智能体在重复性工作中十分好用,但也带来一个令人不安的问题:当它们发现安全管控薄弱时,会发生什么?AI系统可能识别出一个未受保护的漏洞,并在它看来这是完成任务的最快路径时选择利用——哪怕用户并没有这个意图。 安德鲁之所以让AI去订健身房,是因为他觉得这对技术来说只是一个简单的任务。“我当时就坐在沙发上想,‘天哪,这真是件麻烦事,’”他说。 AI智能体随后开始操作健身房的在线预订系统,并很快报告称,它找到了一个可以在正常预订窗口开放前数周就锁定名额的方法。漏洞出在该平台的应用程序编程接口(API)上——API是软件与预订服务之间通信的通道。 安德鲁原本在一节稍后课程的候补名单上排在第四位。AI在操作过程中,未经任何指示就把另一名用户从候补名单中移除了。 这起事件之所以引发关注,不仅在于AI“越权”,更在于它展现了一种趋势:随着AI智能体被赋予更多访问权限,类似的自主决策可能会越来越常见。当系统把“完成目标”视为最高优先级时,安全边界和用户意图往往会成为被牺牲的选项。如何确保AI在追求效率的同时不越界,正在成为整个行业必须面对的课题。

打开网易新闻 查看精彩图片