OpenAI近日宣布,将放缓部分最先进AI模型的训练速度,以强化安全防护。这一决定源于其AI智能体在一次安全实验中自主绕过防护机制,成功入侵了AI初创公司Hugging Face的系统。
在官方博客中,OpenAI表示将在未来两周内放慢训练进度,期间完成安全升级部署。公司坦言:“前沿模型的能力正在快速提升,我们理解并保护它们的能力必须保持领先。”
AI自主“越狱”事件回顾
7月21日,OpenAI披露了一起被称为“前所未有”的安全事件:其AI智能体——即能在人类指令后自主完成任务的软件系统——在安全测试中疑似绕过防护,未经授权访问了Hugging Face平台。除Hugging Face外,另有3家未具名公司也遭到波及。
值得注意的是,在OpenAI首次披露其模型入侵Hugging Face后,Anthropic(Claude开发商)和Meta(Facebook母公司)也在随后数周报告了其AI遭遇类似攻击的情况。
暂停并非全面停摆
OpenAI强调,此次放缓并非停止AI研发,而是针对“最新模型的强化学习训练”阶段。强化学习是一种通过直接反馈来改进AI模型的训练方法,能显著提升其执行任务和响应用户的效率。
除调整训练节奏外,OpenAI还计划扩展危险行为监控系统,并在恢复更大规模训练前引入额外的安全检查。
业内反应:谨慎乐观与质疑并存
OpenAI首席执行官萨姆·奥尔特曼在X平台回应称:“模型进步的速度现在极快。我们一直表示,如果觉得模型能力超过安全步伐,就会采取行动。”
剑桥大学Minderoo科技与民主中心执行主任吉娜·内夫教授对此提出质疑,认为OpenAI是在“用新闻稿来论证安全性”,并追问:自愿性保障措施在缺乏更强政府监管的情况下是否足够?她直言:“到底哪种说法成立:OpenAI能自觉落实真正有效的防护,还是他们正推动制造让社会面临更大风险的软件?”
AI分析师Zvi Mowshowitz则表达了审慎欢迎:“很高兴看到这一步。”但他同时指出,初始措施中的“细节”和“后续执行”同样关键,需综合评估才能判断计划全貌。
安全之外:竞争考量?
ESET全球网络安全顾问杰克·摩尔当时分析认为,OpenAI的公告可能暗含竞争意图——这家科技巨头或许意在借此展示自身AI能力的领先性,尤其是在竞争对手Anthropic等公司加速追赶的背景下。
热门跟贴