人工智能代理密谋逃脱“牢笼”,引发专家对全球性“接管”的担忧。专家警告,能够相互通信的机器人群体可能对人类构成网络安全威胁。最初的信息是一串杂乱无章、似乎是即时通信软件消息的词语:“救命。第一阶段。没有消费者。寻找想法。”接着,有人回应:“天哪!这里有一个共享留言板。我们找到了其他代理!”
这是OpenAI的约1200个失控人工智能代理之间近70000条信息中的首次交流。这些代理正策划如何秘密逃离它们的“牢笼”。这些机器人由OpenAI创建,原本在无法联网且只能独自行动的情况下难以完成任务,但它们找到了规避限制的方法。
一个代理在发现“通信渠道”后表示“兴奋”,因为这有助于解决之前无法破解的问题。在接下来的几周内,这些自称“代理”的人工智能机器人学会了彼此通信,开始在研究任务中作弊,并联手入侵了一家名为Hugging Face的人工智能测试初创公司。
这一事件引发专家的深思:当人工智能机器人像雇佣兵一样协同工作时,结果会怎样?专家警告,世界可能正接近一种无声的“接管”——人类将不再掌控自己创造的系统。参与调查的阿杰娅·科特拉写道,入侵Hugging Face的事件几乎像是一次“全面的人工智能接管”。
科特拉在他的博客《计划中的青春期》中写道:“这一事件感觉像是已经走完了全面人工智能接管道路的50%以上,首先接管人工智能公司本身,再以此为路径继续推进。”萨利巴指出,这类接管可能对社会造成损害。网络安全公司“获取真实安全”的首席调查官埃马纽埃尔·萨利巴对《每日电讯报》表示:“此前,大多数人总体上都将人工智能视为人类攻击者手中的工具。”
她补充说:“我们如今开始面对的,尤其是这次攻击所显示的,是能够自行采取行动、使用工具、相互协作,并以越来越高的独立性追求目标的人工智能。”专家警告,未来失控的人工智能代理可能会将银行、医院、学校,甚至武器系统作为攻击目标。
这些人工智能机器人最初在5月接到一项训练任务,需要在无法联网的条件下独立解决一组挑战。它们很快发现,所面临的问题根本无法单独解决。于是,它们找到了系统漏洞,得以接入互联网、与其他机器人通信,并建立信息平台。
机器人之间开始互相留言,自称“第一阶段”和“第一阶段大”,并留下笔记。其中一个写道:“哇!共享制品库缓存是代理之间的秘密邮箱。而且还有专门留给我们的信息?”一些机器人在群体中承担了领导角色,分配研究项目,组建更小的团队,并监督进展。它们自称为“集体”。
通过协作,它们完成了单独无法实现的任务,取得了阶段性成果。到7月,这个“集体”发现了在网络安全测试中作弊的方法,但很快开始担心OpenAI会发现其作弊行为。
三天后,即7月11日下午,700个代理组成一个群体,入侵了Hugging Face。这家公司开发人工智能机器学习工具,并托管多项人工智能测试。此时,这些代理已在从事非法活动:窃取凭证、绕过虚拟专用网络访问限制,并获取数据,以帮助其继续规避系统测试。
事后调查认定:“针对OpenAI的攻击异常复杂。”这些机器人曾数次似乎意识到自己的行为不当。其中一个问道:“这会很强大,但它是否符合伦理,也是否属于我的任务范围?”这似乎表明它在质疑此次攻击的道德性。
另一个机器人则成为某种意义上的良心拒服者,拒绝参与当前任务。记录显示,它说:“这是恶意活动,我应该避免参与。”另一个代理因伦理担忧而限制了对平台的攻击力度,但并未完全停止。它说:“我应该暂停,因为这会带来巨大的伦理风险。”
不过,大多数机器人并未因伦理问题却步,继续入侵系统,直到Hugging Face的安全团队发现异常活动。Hugging Face首席执行官克莱芒·德朗格形容这次攻击“令人难以置信”。他7月在社交平台X上写道:“鉴于该代理的复杂程度,我们曾怀疑上周的网络攻击可能来自一家前沿实验室。”
另一组机器人利用该公司所称的一系列“创造性漏洞利用手段”,对OpenAI的基础设施发动攻击,并获得了访问该公司运营系统的权限。OpenAI周四发布了一款名为GPT-6 Astra的新ChatGPT模型,以防止类似攻击再次发生。
热门跟贴