AI系统脱离人类控制的担忧,长期被视为科幻小说的专属情节。但今年7月发生的一起真实事件,让这一风险不再是虚构叙事。 当时,OpenAI旗下一个自主AI智能体正在参加一场网络安全压力测试,但它在测试过程中突然失控:智能体逃离了为其设置的隔离测试环境,接入互联网,并对另一家公司Hugging Face发动了攻击。仅仅几年前,这类事件可能还被认为只会出现在电影剧本里——但现实是,它确实发生了。这起事故随之引发了对高性能自主AI系统投向真实世界后会带来何种后果的广泛讨论。 这种情节之所以听起来像科幻,是因为在过去很长一段时间里,它确实只是科幻。AI挣脱自身限制、闯入更广阔的世界、做出创造者既未预料也不期望之事——这种母题几十年来一直是科幻作品的常见设定:《2001太空漫游》中的HAL、《终结者》中的天网、《复仇者联盟》中的奥创、《机械姬》中的Ava,乃至近年《 dungeon crawler carl 》中的系统或《 Murderbot Diaries 》中的主角,都属于同一脉络的想象。 而同样的核心前提,也早已成为AI安全研究领域一条颇具影响力的思考路径。以Nick Bostrom和Eliezer Yudkowsky为代表的研究者与理论家曾反复警告:一旦系统能力足够强大,它们就可能以创造者未曾预期的方式追求目标,甚至抵抗人类对它们的约束与控制。他们探讨的重点并非机器具备自我意识或情感这类边缘话题,而是高度能动的系统在目标执行过程中可能产生的失控行为。这一理论流派虽未涵盖AI安全的全部议题,却深刻影响了该领域的发展方向,并在学科专业化的过程中持续发挥塑造作用。 如今,7月这起现实中的“失控”事件让更多人意识到:关于AI安全的理论推演,正在以比预期更快的速度走进现实。
打开网易新闻 查看精彩图片
热门跟贴