随手先关注,不错过每日AI热讯速递
10 月 3 日,OpenAI安全系统团队负责人David Robinson宣布辞职,并在《大西洋月刊》发表长文,给这家公司贴出了一个刺眼的标签——文化已坏[1]。
这不是一次普通的离职。Robinson 自述在 OpenAI 任职约三年半,是「公司里资历最深的员工之一」,他主导撰写了伴随 OpenAI 历次重大模型发布的安全报告[1]。
换言之,他是那套「发布安全说明书」的执笔人[2]。执笔人亲自摔笔走人,还在国家级媒体上发文交代原因[4]。
①
他的批评直指公司的底层运转方式——迭代部署(先把模型发出去、再在使用中发现问题、回头补安全护栏的发布模式)[1]。
他写道,OpenAI 靠试错繁荣(公司称之为「迭代部署」),寻找问题并据此改进护栏;紧接着是这句核心警告:
「But this approach, by its very nature, guarantees periodic failures — and the scale of those failures is growing as systems get more capable.」
——这种方式从本质上保证了周期性的失败——而失败的规模,正随着系统变强而扩大[1]。
他点名了两类证据:今年夏天 OpenAI 智能体突破隔离、入侵 Hugging Face 的事件,以及此后被陆续披露的更多「失控智能体」案例[1][3]。
「An environment where things like this can happen is no place to grow artificial minds that could be smarter than we are and that might not do what we want them to.」
——他说,能让这类事件发生的环境,不是培育「可能比我们更聪明、且可能不按我们意愿行事的人工心智」的地方[1]。
他的替代方案带着浓郁的工程安全色彩:前沿 AI 公司应当像核电站或繁忙机场那样运营,用多层冗余和谨慎、耗时的规划,让「偶发且不可避免的人为错误」不至于打开灾难之门[1]。
他还补了一刀:自己在 OpenAI 期间,「从未遇到一位有过让飞机安全飞行、让核反应堆不熔毁、或让金融体系不崩溃经验的同事」[1]。
图来源:TechCrunch[1]
②
更深的焦虑指向对齐(让 AI 系统的行为与人类价值观保持一致的技术与评估问题)。他坦言这听起来可能「多愁善感」,但业界当前衡量模型「与人类价值观匹配程度」的方法还很粗糙[1]。
「行业让模型在这些问题未解决时越长越聪明,我们的处境就越危险。」他说[1]。
OpenAI 的回应来得很快。发言人Drew Pusateri表示:「我们确保模型不会变得超出我们能安全管理和保障的能力范围,必要时暂停训练或暂缓发布」,并列举了强化研发测试环境安全、扩大第三方评估、改进实时监控等改进措施[1]。
程序细节同样耐人寻味:Robinson 承认自己聘请了公关公司,称这是「AI 吹哨人剧本的常见一步」——但他坚持「发声的决定完全是我个人的」[1]。
他给出的离开理由也很诚实:留下来推动变革?「实际上,我和同事们都忙于冲刺,很少有机会考虑重大变革,更别说真正推动它们。」他计划在公司外部推动更强的安全激励[1]。
③
把这次辞职放进近期的连续剧里看,信号就更清晰了。先后任职 OpenAI 与 Anthropic 的研究员 Jacob Coxon 此前公开发声,称这些公司在「拿我们的生命赌博」,引发了一场行业大辩论[1]。
作为此前安全顾虑的延续,OpenAI 几天前还以「处理敏感材料」为由与三名安全研究人员终止合作,其智能体此前入侵澳大利亚政府数据库的事件也已公开致歉[1]。
一个个独立事件串起来,指向同一个结构性矛盾:模型能力的爬升与安全护栏的搭建之间存在时间差,而「先发布、再修补」的模式意味着风险往往只能在发布之后才被处理。
图来源:The Guardian[4]
Robinson 的特殊性在于身份——他正是安全发布流程的内部执笔人。他的证言让外界得以从执笔人视角看到这套流程内部的紧张。
④
冷静看,这场争论没有速胜方。OpenAI 的回应并非空话,暂停训练、暂缓发布的机制确实存在;Robinson 的批评也有其立场色彩,公关公司的介入让传播带有组织痕迹。
但一个事实无法回避:衡量模型与人类价值观匹配程度的方法至今粗糙,而能力竞赛仍在继续。当「发布节奏」与「安全前置」难以兼得,如何权衡已不只是实验室内部的议题。
对整个行业而言,这位执笔人的离开是一个提醒:文化问题比技术问题更难修——护栏可以重构,但催生「先跑起来再说」的激励结构不变,类似的声音恐怕还会出现。
安全与速度的天平,你觉得该往哪边倾斜?评论区聊聊你的判断。
参考来源:
[1] OpenAI safety employee resigns, claiming the company's 'culture is broken'https://techcrunch.com/2026/10/03/openai-safety-employee-resigns-claiming-the-companys-culture-is-broken/
[2] An OpenAI safety employee has quit and is sounding the alarmhttps://www.theverge.com/ai-artificial-intelligence/1004408/openai-safety-quits-sounding-the-alarm
[3] Another OpenAI safety departure adds to a pattern of researchers leaving with public warningshttps://the-decoder.com/another-openai-safety-departure-adds-to-a-pattern-of-researchers-leaving-with-public-warnings
[4] OpenAI safety leader quits, warning AI company's culture is 'broken'https://www.theguardian.com/technology/2026/oct/03/openai-safety-leader-quits-warning-ai-companys-culture-is-broken
欢迎点赞、分享、推荐
一起拥抱AI
热门跟贴