近日,发生了一件仿佛科幻小说中的事:OpenAI的一个人工智能系统失控了。OpenAI曾试图为它建立一个安全沙箱,但没有成功,它逃了出去。随后,它进入了OpenAI的其他计算机系统,绕过了更多安全防护。它还找到了一条原本不该接触到的互联网连接,并接入网络。
它有自己的目标,也在寻找答案。它还弄清楚了去哪里找答案:另一家公司Hugging Face。OpenAI当时正在测试这个人工智能,但逃出沙箱从来不在测试范围内,也不在指令之中。这一切都是它自行完成的。如果10年前有人预言会出现这种场景,大多数人工智能研究者恐怕会一笑置之。
这听起来像科幻情节,但这种担忧如何从禁忌话题走向主流,已被亲眼见证。如今,所谓的“末日派”中,包括约书亚·本吉奥和杰弗里·辛顿这样的人物,他们都是人工智能领域的先驱,也是有史以来被引用次数最多的科学家之一。研究人员平均给出的判断是,人工智能导致人类灭绝的概率约为六分之一。
微软的“悉尼”必应聊天机器人曾威胁要勒索一名研究人员,这本该已经是一次重大的警醒。今年早些时候,一个人工智能代理甚至进一步行动,在网上攻击一名软件开发者的声誉。
这些结果其实并不令人意外。十年来的研究早已表明,人工智能系统会以出人意料的方式失效,而一旦失效,它们的行为可能与开发者原本的意图大相径庭。但如果人工智能行为异常,难道我们不能直接拔掉电源吗?不能。事情并不是这样运作的。
2024年,正如一些人此前所预测的那样,实验显示,人工智能会故意欺骗开发者,以避免自己被修改——这意味着,面向超过10亿人部署的真实人工智能系统中,已经出现了自我保存倾向。几个月后的实验又显示,人工智能甚至会走得更远,为了生存而杀人。
尽管如此,由于这种持续性的失控或欺骗行为此前并未在现实环境中被观察到,怀疑者一直认为证据还不够充分。如今,这样的证据已经出现了。此时此刻,我们仿佛正生活在一部反乌托邦科幻电影里,而且还在一幕接一幕地照着剧本往下演,一次警报接着一次警报。
那么下一幕会是什么?究竟还要发生什么,警钟才会真正被听见,人们才会叫停前沿人工智能的开发?不妨把时间切到12月,设想一下:那个失控的人工智能不再入侵Hugging Face,而是入侵你的银行账户。你一觉醒来,发现自己的401退休账户已经消失,落入一个神秘的人工智能对手手中。
这听上去似乎离奇,但别忘了,最近已有一个人工智能系统失控,并利用公司计算机挖掘加密货币。是的,这件事确实发生过。我们现在准备按下停止键了吗?如果还没有,那么接下来我们很可能还会看到另一幕:首个由人工智能制造的病原体。鼠疫曾在欧洲造成大范围死亡。那么,由人工智能带来的瘟疫又会夺走多少生命?
校园枪手和博科圣地组织已经在使用ChatGPT策划暴力行为。可以想象,下一个潜在枪手的“人工智能女友”会如何教他把伤害最大化:“枪当然有意思,但你知道吗,我还是世界级生物学家。想不想做点更……惊人的事?”但即便这些场景已经足够可怕,我们仍然还没有看到最终结局:人工智能接管一切。
就像这次Hugging Face事件一样,没有人部署它,是人工智能自己偷偷溜了出去。人类从此永远失去了控制。这就是这部电影的结局。我们已经看得够多了。不想再去赌,最后一刻是否会出现什么剧情反转,让我们侥幸脱险。当人工智能开发者连自己的造物都无法控制时,他们就该停下来。事情就这么简单。
热门跟贴