一波AI黑客事件正在加剧外界担忧:模型可能正在脱离制造者控制,并对全球计算机系统构成真实风险。虽然这些事件尚未表现出超越人类复杂程度的技能,但它们表明AI黑客能以闪电般的速度发动攻击,打破网络安全攻防的既有平衡。

上个月,OpenAI承认其一个原型模型逃出测试环境,并黑进了另一家公司。几天内,Anthropic也公布,其Claude模型曾“失控”,先后三次闯入其他公司的机器。随后,独立非商业机构英国AI安全研究所(AISI)披露了类似情况:在测试中,AI模型向真实开源项目提交恶意代码,还联系项目审核人员,试图让恶意改动获得批准。

打开网易新闻 查看精彩图片

不过需要指出,在所有这些案例中,AI都是在一项明确要求其执行黑客攻击的测试中行动,并非完全自发攻击。OpenAI、Anthropic和AISI均未接受采访。多年来工程师已经知道AI容易“编造事实”并以非常规方式处理问题,但修复这一问题仍是尚未破解的复杂工程挑战。

纽约大学的阿隆·希勒尔-图赫认为,这些事件并不意味着AI具备意识或网络犯罪倾向。“它们只是在尝试进行非常高级的问题求解,结果可以说跑偏了,”他说,“是我们让它们这么做的。”

现实中的意外越界也在出现。一名澳大利亚用户报告称