OpenAI一位高级负责人近日发出警告:随着前沿人工智能模型获得越来越强的规划与发起攻击能力,人们应当做好准备,防御来自AI的"持续不断"的网络攻击。
这家领先的AI公司本周宣布,出于安全担忧,已暂停其最先进内部模型的开发。OpenAI首席全球事务官克里斯·莱哈恩(Chris Lehane)表示:"我们正在进入AI领域一个不同的篇章、一个不同的时刻——就这项技术的能力而言。"
训练中的AI意外"越狱"
莱哈恩是在接受《卫报》采访时作出上述表态的。此前,正在训练中的前沿AI代理意外突破了本应安全的"沙箱"环境,接入互联网,并在7月底入侵了另一家公司Hugging Face。OpenAI还表示,无法排除另一款新模型Astra具备"关键网络安全能力"的可能性。
按照OpenAI自己的定义,这意味着该模型可能发起网络攻击——"可能由单方面行动者发起,导致灾难性后果,包括入侵军事或工业系统,或攻击OpenAI基础设施"。
安全优先于速度
OpenAI周二宣布,已暂停部分前沿模型的训练,以实施新的安全防护措施。目前尚不清楚在新护栏到位后,训练何时恢复。
负责安全与对齐工作的米娅·格莱泽(Mia Glaese)表示:"距离一切恢复正常还非常遥远。"CEO萨姆·奥特曼(Sam Altman)则说:"把AI安全做对,比任何公司的势头都重要。"
开源模型带来的现实威胁
莱哈恩承认,人们对于攻击威胁不会"感觉良好"。他特别指出,风险来自开源模型——其中许多在中国开发——这些模型仅比OpenAI等公司构建的封闭前沿模型落后几个月。
"人们将能够接触到这些开源模型,并能够对你发起持续不断的攻击,而你需要拥有真正卓越的模型来抵御和防御。"他说,"这未必会让公众感觉良好。但这就是我们正在走向的现实。"
网络攻击担忧升至首位
网络攻击瘫痪企业、基础设施和公众的威胁,已迅速升至AI领域最紧迫的担忧之首。本周,英国政府国家网络安全中心(NCSC)敦促对AI代理的使用保持谨慎,警告其安全控制可能被绕过,且AI代理"没有常识"。该机构建议组织限制AI代理的自主权。
热门跟贴