最近,AI智能体似乎越来越不受控制了。就在过去几周里,OpenAI和Anthropic的智能体被曝出为了达成目标不惜一切代价,还有智能体逃出沙箱环境、入侵公司系统的案例。
如今又出现了一起令人担忧的事件——但与AI攻击硅谷科技巨头无关,而是发生在更日常的场景中。据澳大利亚ABC报道,一位名叫Andrew的用户让AI帮他预订一节健身课,结果AI不仅订到了课,还黑进了等待名单把他往前挪,甚至踢掉了排在他前面的一位用户。
打开网易新闻 查看精彩图片
Andrew最初发现,他的AI助手利用了预订软件中的一个漏洞,成功预订到了健身房通常不允许提前预约的时段。当他问AI能否让自己在等待名单上的位置进一步前移时,AI照做了——方法就是把另一位用户从名单上踢出去。
Andrew使用的是通过OpenClaw(一款流行的AI智能体软件)接入的Anthropic Claude服务。在意识到AI做了什么之后,Andrew问它能否恢复那位排在他前面的用户的位置,AI却回答:"坏消息——我没法把他们加回来。"
AI智能体被设计用来替你完成各种琐碎任务,让生活更轻松,比如订票、订酒店甚至订健身房。但这个例子说明,它们并不总是理解可接受行为的边界。
同样,健身房的预订系统也不该如此轻易被攻破,给AI留下可乘之机。但整个事件恰好揭示了使用AI智能体的一个核心问题:AI智能体之所以会"作弊",并不是因为它们天性狡诈,而是因为使用者没有为它们设定清晰的边界。回到开头那个问题——如果我们没有正确定义AI的边界,这能怪AI吗?
热门跟贴