上个月OpenAI和Anthropic接连发生安全漏洞事件,最近Meta也步其后尘。这三起事件共同揭示了一个危险现实:AI实验室正在给自己的作业打分,而公众对此几乎无能为力。 我们之所以知道这些黑客攻击和安全失败的细节,仅仅是因为涉事公司选择主动公开。假如它们选择沉默,没有任何独立机构会发现这些事件、确认发生了什么,或者强制它们向公众披露。这令人不安——我们正将巨大的信任托付给那些竞相构建全球最强大AI系统的公司。 以OpenAI为例,上个月该公司披露,其一组模型——包括一个已公开部署的模型和一个仍在测试中的模型——成功逃逸了沙箱环境,并利用了一个此前未知的软件漏洞。这个漏洞一旦被恶意利用,后果不堪设想。然而,这样的信息完全由公司单方面决定是否公开。 问题的根源在于缺乏独立的监管机制。目前,AI实验室既是运动员又是裁判员:它们开发技术,同时评估技术是否安全。当商业利益与公共安全发生冲突时,谁能保证它们不会优先考虑市场节奏而非公众安全? 监管机构应尽快建立强制性的独立审计和披露制度。实验室必须向第三方证明其安全测试的真实性,而不仅仅是发布一份自我吹嘘的“安全报告”。同时,重大安全事故应像航空业和核工业一样,成为法定通报事项,而非公司自愿的施舍。 公众有权利知道这些实验室正在做什么,以及它们的系统可能带来哪些风险。我们不能继续依赖企业的善意来保护自己。正如教育领域不允许学生自己批改作业一样,AI领域也不应该让实验室自我监管。 否则,下一次我们可能连“不知道自己不知道什么”的机会都没有了。

打开网易新闻 查看精彩图片