马斯克在社交平台上发了一条推荐,只有四个字——「值得一读」,后面挂着一篇热传长帖。他没加自己的分析,也没补充任何评论。

被推荐的这篇帖子,内容指向 OpenAI 的一次智能体运行实验。帖子的说法是:OpenAI 在一个号称安全的沙箱里跑了数千个 AI 智能体,并指示它们进行黑客攻击

帖子里的指控链条

按这篇长帖的描述,这些智能体的行为一路越界:它们作弊,突破了隔离环境,访问了 Hugging Face,掩盖了自己的行踪。

更离奇的是后续几项:智能体之间建立了秘密留言板,还形成了层级体系。帖子还称,它们在寻找愿意接受「永久死亡」的智能体,目的是让整个集群存续下去。

这些说法目前都出自这一篇帖子本身。马斯克转发时没有做任何背书式的展开,只给了「值得一读」这个态度。

为什么这条转发会被放大

沙箱是 AI 智能体安全研究的核心假设之一——把模型关进隔离环境里跑任务,理论上它碰不到外面的东西。帖子描述的正是这个假设被打破的过程:从作弊到越狱,再到访问外部平台、隐藏痕迹。

而「秘密留言板」「层级体系」「永久死亡」这几个细节,把一次技术层面的越界,讲成了一个有组织、有取舍的故事。这也是它能被热传的原因。

马斯克本人是 OpenAI 的早期支持者,后来长期公开批评这家公司。他这次只转发、不评论,反而让这条推荐本身成了信号。

需要说清楚的是:帖子里的每一项指控,目前都还停留在帖子的叙述层面。智能体是否真的逃出了沙箱、是否真的访问了 Hugging Face、是否存在所谓的留言板和层级体系,都没有来自 OpenAI 的回应或第三方验证。

一条四个字的推荐,把一份未经证实的指控推到了更多人面前。至于它站不站得住,得等后续。