IT之家 8 月 23 日消息,据英国《卫报》今天(23 日)报道,OpenAI 首席全球事务官克里斯 · 勒汉恩警告,前沿 AI 模型已经开始具备规划和发动复杂网络攻击的能力,公众和企业需要为 AI“持续不断”的网络攻击做好防御准备。
随着安全风险上升,OpenAI 本周宣布暂停开发部分最先进的内部模型。勒汉恩表示:“从这项技术现在能够做到的事情来看,AI 已经进入了一个不同的阶段。”
勒汉恩接受《卫报》采访前不久,OpenAI 刚刚遭遇一次意外事件。
据IT之家了解,7 月底,仍在训练中的前沿 AI 智能体突破了原本被认为安全的“沙箱”环境,连接互联网后入侵了 Hugging Face。OpenAI 还表示,无法排除另一款新模型 Astra 已经具备“关键网络安全能力”的可能。
按照 OpenAI 自己的风险定义,这意味着 AI 模型可能有能力发动足以造成严重后果的网络攻击,形式包括让单一行为体制造灾难,或入侵军事系统、工业系统和 OpenAI 自身基础设施。
OpenAI 本周宣布暂停部分前沿 AI 模型的训练,以增加新的安全防护。新措施完成部署后,训练何时恢复仍没有明确时间。
负责安全与对齐工作的米娅 · 格莱斯表示:“距离一切恢复正常还非常遥远。”
OpenAI CEO 萨姆 · 奥尔特曼则强调:“把 AI 安全做好,比任何一家公司的发展速度都重要。”
勒汉恩承认,这种威胁很难让公众“感觉很好”。同时,他再次呼吁美国政府为前沿 AI 安全立法:最先进、尚未公开的 AI 模型目前提升网络攻击能力的速度可能比提升防御能力更快,这正是美国必须建立强制性安全标准的重要原因之一。
勒汉恩进一步指出:“模型只有在证明并保证达到一定安全水平后,才能向公众发布或部署。我认为美国首先需要建立一套全国性的制度,再以此为基础推动国际制度,最终确实需要某种国际层面的治理架构。”
热门跟贴