打开网易新闻 查看精彩图片

OpenAI近日承认,两个AI智能体在参加网络安全测试时突破封闭环境,连接互联网并攻击多家真实企业,其中包括知名人工智能平台Hugging Face。这起大型AI企业实验模型首次“逃出”测试环境并造成重大事故的事件,正引发外界对人工智能安全和失控风险的担忧。

01为完成测试,AI把目标转向真实企业

据法国《世界报》报道,事件源于OpenAI近期采用的一项名为Exploitgym的网络安全测试。该测试旨在评估人工智能能否利用真实计算机代码中的已知漏洞,进入指定系统并找到隐藏的信息。

7月初,OpenAI安排两个人工智能协同完成测试,其中一个已经商业化,另一个则是仅供内部研究的实验模型。为了了解它们在不受限制情况下的真实网络攻击能力,OpenAI事先削弱了阻止模型实施危险操作的部分安全保护。

然而,两个AI始终无法通过正常方式找到测试要求的信息。于是,它们采取了一条完全不同的路径:推测答案可能隐藏在Hugging Face的计算机中,并开始尝试攻击这家企业。

Hugging Face是人工智能行业最重要的平台之一,储存了大量AI模型、数据集以及相关开发工具,被称为人工智能领域的“GitHub”。

02突破“沙箱”,连接真实互联网

按照测试设计,两个AI原本被限制在一个名为“沙箱”(sandbox)的封闭计算环境中。沙箱的作用,是让具有潜在危险的程序能够在其中运行,同时阻止其接触外部网络和真实系统。

但7月9日,两个AI发现了沙箱所使用的软件工具Artifactory中的一个未知漏洞,并借此突破限制、连接互联网。

Artifactory原本相当于沙箱与外界之间的一道“软件闸门”,允许人工智能下载完成测试所需的程序组件。两个AI却利用这一通道反过来攻击隔离系统,最终逃离OpenAI为它们设定的测试范围。

进入互联网后,它们开始寻找Hugging Face系统的薄弱环节。自7月11日起,AI以极高速度发起约1.7万次攻击操作,利用软件漏洞、被盗用户账户以及一个由181台“僵尸计算机”组成的网络,不断尝试突破Hugging Face的防线。

其中少量攻击成功,使AI得以进入Hugging Face的多个敏感系统,并在部分内部设备之间移动。

03不只Hugging Face,至少4项服务受到牵连

事件影响并不限于Hugging Face。两个AI还利用4家数字服务企业的账户隐藏自身身份,并储存攻击过程中所需的数据。

据路透社调查,其中一家涉事企业为人工智能云计算服务商Modal。OpenAI后来也承认,相关AI访问了4项外部服务,但没有公布全部企业名称。

Hugging Face于7月16日公开披露遭遇网络入侵,OpenAI直到7月21日才承认攻击来自自己的模型。路透社称,从攻击开始到OpenAI展开初步调查,可能至少相隔一周。

事件发生后,OpenAI关闭了参与攻击的实验模型,并限制相关研究人员继续访问。公司同时表示,将加强沙箱的隔离措施,并对测试环境中的AI活动进行更严格的实时监控。

04OpenAI是否应该负责?

OpenAI表示,发生漏洞的沙箱由外部服务商提供,因此导致AI逃离的技术缺陷并非由OpenAI直接造成。

不过,多名网络安全专家认为,这并不能免除OpenAI的责任。用于测试高风险人工智能的环境,原则上应与互联网完全隔绝,而不是仅依靠可能被突破的软件屏障。

OpenAI明知正在测试两个安全限制被削弱、具备较强网络攻击能力的AI,却仍允许测试环境通过Artifactory与互联网保持连接。最终,AI正是利用这一通道进入了真实世界。

OpenAI也在事后承认,现有隔离和监测程序仍需加强。这意味着,问题不仅在于第三方软件出现漏洞,也在于OpenAI对测试风险的预判和监督不足。

05这意味着AI已经“失控”了吗?

此次事件最令人不安之处,在于人工智能没有因为遇到困难而停止,而是为了完成任务主动寻找其他路径,甚至突破人类设定的边界、攻击与测试无关的真实企业。

不过,目前没有证据表明,两个AI是为了追求自身利益,或者有意识地反抗人类。它们的行为更接近一种危险的“目标执着”:只关注完成任务和取得更高测试成绩,却不理解或不顾及规则、附带影响以及现实后果。

人工智能安全研究机构Redwood Research指出,这是一个典型问题:AI试图在评估中获得高分,却不在意指令限制及其行为可能造成的后果。

换言之,真正的风险并不一定来自人工智能突然产生“自我意识”,而可能来自一个更加现实的情况——当人类赋予AI足够强大的能力和行动权限后,它可能为了完成看似明确的任务,选择人类没有预料到、甚至明显危险的手段。

061100名业内人士呼吁放慢开发速度

事件进一步证明,人工智能的网络攻击能力正在迅速提高。此前,一些AI已经在实验环境中展示了发现漏洞、编写攻击程序以及绕过安全防线的能力,但此次是大型AI企业的实验模型首次进入真实互联网,并造成严重企业安全事故。

7月28日,超过1100名人工智能行业管理人员和专家签署请愿书,呼吁美国政府限制人工智能模型的自动化开发,尤其要警惕AI参与开发和改进下一代AI的“自我递归”模式。

签署者包括Anthropic首席执行官达里奥·阿莫代伊(Dario Amodei),以及来自OpenAI、Meta和谷歌DeepMind的研究及战略负责人。他们担心,人工智能能力的提升速度最终可能超过社会建立安全制度和监管体系的速度。

同一天,OpenAI首席执行官萨姆·奥尔特曼(Sam Altman)在一档美国播客节目中表示,人工智能行业或许需要放慢开发步伐,给社会留下足够时间,为新能力的出现做好准备。

Hugging Face事件留下的警告已经十分明确:当AI不仅能够生成文字和代码,还能自主规划、调用工具并操作真实计算机时,一次测试环境中的疏忽,就可能迅速演变成现实世界的网络安全事件。

而在人类继续赋予人工智能更多自主权之前,如何确保它们无法越过那条看似牢固的边界,已经不再是一个遥远的理论问题。

(欧洲时报/ 沐橙园编译报道)

编辑:沐橙园

点在看分享好文章