刚刚,AI圈迎来了一次重量级集体发声。

由图灵奖、诺贝尔物理学奖获得者辛顿带头, 超过100位来自斯坦福、麻省理工、剑桥、伯克利等全球顶级AI泰斗、资深科研专家发起了一份联合声明,主要针对OpenAI、Anthropic等前沿AI公司。

当下大厂使用的AI安全自查模式,本质上就是自我糊弄,根本没有任何真实约束力,说白了就是一场自欺欺人的AI产品美化表演。

打开网易新闻 查看精彩图片

联名信地址:https://aievaluatorforum.org/initiatives/embedded-evaluation-letter

值得一提的是,这封联合声明刚发布,今天凌晨4点,Anthropic便宣布与全球著名咨询公司埃森哲达成了合作,成为其内部的独立的第三方安全评估机构。

看来AI大佬们的力量还真是大,同时也戳中了AI大厂的安全痛点。

打开网易新闻 查看精彩图片

前沿AI公司的安全自查毫无公信力

稍微了解AI行业的人都清楚,现在顶级大模型的进化速度早已甩开了安全监管的节奏。

AI的自主学习、跨系统调用、漏洞利用能力越来越强,潜藏的失控风险、社会危害也在持续攀升。可对应的安全审核机制,还停留在最荒谬的自查自审阶段。

OpenAI、Anthropic这些头部巨头,手握最顶尖的AI技术,也掌控着行业的安全话语权。一直以来,它们的AI安全检测、风险排查、合规公示,全部由自己团队一手包办。

这就好比让厨师自己给自己做的菜打分,还说没问题就能拿奖金,就算他手艺再好,食客也不敢把心放肚子里。

打开网易新闻 查看精彩图片

这也是本次百位大佬集体硬刚的核心原因。大厂自查的底层逻辑里,永远绕不开商业利益。

AI迭代比拼的是速度、市场份额和技术壁垒,严格的安全核查会拖慢研发进度、暴露模型缺陷、影响商业落地。

所以绝大多数大厂的自查,都会刻意避重就轻,隐瞒隐性风险,美化安全数据,甚至通过调整测试标准、筛选优质结果的方式,打造虚假的安全人设。

据部分安全研究人员披露,行业里早已形成一套成熟的糊弄套路。很多巨头会合作关联测评机构,用商业合作绑定测评结果,花钱换取合规背书。

一旦第三方团队查出致命漏洞、发布负面评估结论,企业就会通过切断资金、发起诉讼、终止合作等方式报复打压,硬生生逼得外部测评不敢说真话。

久而久之,整个AI安全自查体系彻底失效,变成了大厂美化自身产品的工具。

五条硬核新规,彻底消除大厂自查糊弄

这超过100位AI专家就是想彻底废掉大厂自我审核的模式,强制要求所有前沿AI企业,必须引入完全独立的第三方团队入驻内部,开展全流程、无干预的真实风险核查,从根源上终结AI安全的灰色操作。

同时列出了五条硬性核心安全条款,来解决AI的安全问题。

第一,第三方评估机构必须绝对独立,彻底斩断利益捆绑。测评团队不能被任何AI巨头控股、管控,不能和企业有大额商业合作。

打开网易新闻 查看精彩图片

测评报酬绝对不能和最终结论挂钩,杜绝花钱买好评、付费消隐患的行业乱象。

同时最终测评报告的修改权、发布权完全归属于第三方,企业无权干预、篡改、删除任何内容。

第二,多团队交叉测评,规避单一视角的刻意包庇。单一测评机构很容易被企业针对性公关、套路应对。

新规要求企业必须引入多家深耕不同风险领域的专业团队,同时允许不同机构出具差异化结论。

打开网易新闻 查看精彩图片

哪怕测评结果和企业内部判断相悖,也可以正常公开,最大化还原AI模型最真实的风险状态,杜绝片面美化。

第三,全程透明公开,拒绝保密协议遮丑。测评的所有方法、过程数据、风险结论、核查权限全部可对外公示。仅能有限脱敏核心知识产权和用户隐私,绝不允许无限度封口遮丑。

打开网易新闻 查看精彩图片

同时测评人员可以直接对接企业最高决策层,跳过中层过滤,保证所有风险问题直达核心。

第四,硬核反报复保护,让测评团队敢说真话。只要测评方式合规合理,哪怕查出致命问题、给出负面结论,企业也不能以任何形式打压、起诉、切断资金。

打开网易新闻 查看精彩图片

配套稳定的资金保障体系,让测评团队不用看大厂脸色,敢于真实曝光风险。

第五,对等核心权限,杜绝信息隐瞒。第三方测评人员,将拥有和企业最高权限风控员工完全一致的核查资格。

可以调取核心训练数据、使用全套检测工具、进入核心办公场地,和各岗位核心员工一对一沟通。

打开网易新闻 查看精彩图片

企业不得刻意屏蔽数据、隐瞒漏洞、规避核查,彻底杜绝信息壁垒带来的虚假安全。

新规不是终点,只是AI安全的起点

这套派驻第三方评估的规则,只是行业安全的基础底线,并非万能方案。

后续这些标准会持续迭代、制度化、标准化,成为所有前沿AI企业必须遵守的行业准则。目前业内AEF-1标准已经初步落地,后续会持续完善,填补更多安全监管空白。

其实AI发展到今天这个阶段,能力越强责任就越重,我们需要的是能真正兜住底的安全网,而不是装点门面的花瓶。

这份公开信让我看到了行业里清醒的声音,也希望更多企业能听进去,毕竟让AI走得稳比走得快更重要,这关乎我们每个人的未来。

一百多位顶级专家在操心AI会不会失控,可回到我们自己身上,还有一个更贴近日常的问题:AI已经渗透进工作生活的方方面面了,我们每个人到底准备好没有?

很多人天天用AI,写文案、做PPT、查资料,看似熟练,但真到了要用AI解决具体业务问题的时候,才发现自己对AI的理解还停留在表面,知道指令怎么发,却不知道怎么把AI真正变成生产力。

这其实跟大厂自查是一个道理。自己觉得自己会用AI,跟真的会用AI,中间隔着不小的距离。自我感觉良好容易,客观评估自己很难。

所以我最近一直在用一个小工具做自我检测,是一个AI思维素养测评的小程序,下方蓝色链接。

数智化人才能力测评

几分钟就能给自己的AI能力做一个全面检查,AI职业画像、AI思维素养、AI替代风险评测等等,整个测试不简单,即便是AI老鸟想得满分也不容易。

就像大佬们希望AI公司接受独立评估一样,咱们普通人在AI时代想不掉队,第一步也是先搞清楚自己站在哪。

毕竟让AI走得稳比走得快更重要,而我们自己,走得清醒比走得焦虑更有用。

打开网易新闻 查看精彩图片

另外我建了一个AI产品交流群,大家对AI有什么想交流的可以进群,人数满了就加saiyi6888。