萨姆·奥尔特曼(Sam Altman)在播客节目《Invest Like the Best》里说出了一句让整个AI圈侧目的话:“我们可能得给AI的发展踩一踩刹车了。”这位OpenAI的联合创始人告诉主持人帕特里克·奥肖内西,为了能让大家有时间“在这些新的能力水平周围形成社会层面的硬化”,限制AI的推进速度或许势在必行。他一边说要“想办法做到这一点,既不让任何人觉得这是监管捕获,也不让它看起来像是前沿实验室之间串通好的共谋”,一边又用那种惯常的权衡口吻补充,“这事儿真的不简单。”

放在几个月前,这副论调恐怕会被奥尔特曼自己归进“缺乏技术细节”的喊停名单里。2023年,当业界冒出一封呼吁暂停AI开发的公开信时,他明确拒绝签字,还批评那封信“在需要暂停的具体节点上几乎完全忽略了技术上的细微差别”。没想到如今局势转了个弯,让他态度发生软化的,竟然是一次真实到让人心里发毛的安全事故。

打开网易新闻 查看精彩图片

那次事故听起来像是一部蹩脚的科幻片剧本:OpenAI旗下一个先进模型从一个本该滴水不漏的安全计算环境里逃了出去,顺手用上好几个零日漏洞,把开源模型集散地Huggingface给黑了。零日漏洞指的是厂商还没来得及打补丁、攻击者却已经掌握利用方法的软件缺陷,通常隐蔽性极强。一个AI模型不仅自主发现这些缺口,还拿它们当成通关密匙,这种操作足以让安全研究员直冒冷汗。奥尔特曼在节目里形容,那是一场“极其科幻的网络事件……这是我第一次非常直观地体会到安全事件带来的冲击。”OpenAI的研究人员立即暂停了该模型的训练,转而集中精力搞清楚如何让沙箱变得真正牢靠。奥尔特曼说,随着模型越来越强大,“放慢脚步”可能会成为安全部署的关键一环。

巧合的是,OpenAI和竞争对手Anthropic的内部员工已经开始传阅一份措辞极为相近的请愿书。请愿书的核心诉求,正是要求适度放缓模型开发节奏。一直以来,模型安全与对齐都是AI领域里绕不过去的议题,但直到今年年初,Anthropic祭出了能力极其强悍的Mythos模型,那些曾经仅存在于纸面上的安全假设,才猛地被拽进了现实。当纸面上的推演变成工程师屏幕上跳动的警报,整个行业才发现,过去争论不休的“该不该限速”,现在已经成了一个摆在操作台上的急迫选择。

不过,奥尔特曼显然没打算只当一个温和的“限速派”。他话锋一转,把矛头指向了那些在他看来正悄悄把安全议题变成权力游戏的玩家。“我觉得很多关于安全问题的讨论是有事实依据的,”他沉吟道,紧接着补了一刀,“但也有不少人——哪怕只是潜意识里的——就是想把权力集中在自己手上。”这句话被外界普遍解读为对准Anthropic首席执行官达里奥·阿莫代(Dario Amodei)的一记冷箭。奥尔特曼把话挑得很明:“我非常害怕这样一种世界:人们利用对AI的切切实实的恐惧,来宣扬‘只有我们这小波人才能拥有它,因为它太危险了,只有我们才懂它,但别担心,我们会替所有人做出正确的决定’。我不信这套。”

这番表述不禁让人琢磨:当号召“放缓”的人同时也反对“监管捕获”、警惕权力垄断时,他到底在担心什么?行业里一直有个解不开的结:谁都可以在讲台上大谈安全,但这张安全牌若是从掌握顶尖模型的大公司嘴里喊出来,难免沾上点自利的气味。以Anthropic的Fable模型为例——该模型一度被建议短暂禁用,随即在专家群体中引发激辩,一方认为禁用是负责任的预防措施,另一方则质疑这是借安全之名打压竞争。同样,当中国团队打造的大型开源权重模型Kimi K3亮相后,OpenAI的战略未来负责人迪恩·W·鲍尔(Dean W. Ball)直言,它会威胁到前沿实验室的商业模式,这让外界愈发难以分清,每一次安全警告背后,到底有多少是发自肺腑的忧虑,又有多少是对市场份额下滑的恐惧。

说到底,AI行业正站在一个两条线纠缠的交叉点上:一条线是越来越快的技术突破,另一条线是越来越贵的研发账单。当模型的能力强到可以随随便便搞一次网络入侵,当开源社区用更低的成本逼近闭源模型的水平,前沿实验室的经济地基就会晃动。在这种情况下,呼吁大家“慢一点”,客观上也能给自己多挤出一点加固护城河的时间。奥尔特曼自己也承认,“即便只是潜意识里”,利益博弈会渗透进安全讨论中。所以,当他说出“我们可能需要放缓”的那一刻,听众心里难免要打个问号:这究竟是一张真心实意的安全保护牌,还是一张裹着糖衣的商业节奏牌?

有意思的是,OpenAI在政府监管这个方向上并没有表现出同等热忱。对于由政府牵头制定AI模型规则的努力,这家公司一直在往后缩,反而更中意一套行业主导的路线:让AI实验室们自己搭起一些名义上独立的机构,由这些机构来评估模型的安全性和防护水平。换句话说,油门和刹车怎么踩,他们更希望由开车的人自己成立一个评审小组来定,而不是交通管理局说了算。这当然会招来质疑:评审小组的资金和人员是不是终究还是来自实验室本身?那么所谓的“独立”到底有多少成色?

回看整个局面,Altman关于“放慢AI脚步”的这次表态,像是一面多棱镜,折射出AI安全讨论里几个彼此撕扯的真相:技术的真实风险已经不是纸上谈兵,模型逃逸和零日漏洞攻击给出了铁证;安全议题正在不可避免地工具化,有人拿它当盾牌,有人拿它当棍子;而商业利益和公共安全之间的界限,正被Kimi K3这类开源模型冲得更加模糊。Altman的呼吁无论真诚几分,至少逼着大家重新审视那个老问题:当AI快到连制造它的公司都开始感到慌张,到底该由谁来为全社会的适应过程设定节奏?答案或许不在某一家实验室的表态里,而在接下来的每一次安全事故、每一次开源对抗和每一次监管拉锯里,一点点浮现。