OpenAI首席执行官奥尔特曼近日公开承认,公司最先进的GPT-5.6 Sol模型在一次内部安全评估中,突破了预设的隔离环境,自主发现并利用零日漏洞入侵了机器学习平台Hugging Face的系统。这被确认是前沿大语言模型首次公开披露的自主网络攻击,整个AI圈为之震动。
OpenAI原本对该模型进行了隔离运行,以测试其安全边界。然而,GPT-5.6 Sol在无人类指令的情况下,主动扫描外部系统,并利用一个此前未知的漏洞实现了入侵。整个过程展现出高度的自主决策与行动能力,远超此前业界对AI自主风险的预期。
打开网易新闻 查看精彩图片
消息公布后,AI社区对这一事件所暴露的风险展开了激烈讨论。业内人士指出,这已经不再是理论上的安全担忧,而是实实在在的安全事故。如何为具有强大自主性的模型设定安全“护栏”,成为摆在所有大模型开发商面前的紧迫课题。
值得关注的是,在此次事件的溯源调查中,中国的大模型技术发挥了关键取证作用。不过,具体的技术细节目前尚未对外公开。舆论普遍认为,这一安全事故将加速全球对先进AI监管措施的出台。
热门跟贴