内部代码库里的“研究员”

OpenAI尚未发布的基座模型Astra,已经在公司内部代码库中直接参与实验工作。据OpenAI首席科学家Jakub Pachocki接受《时代》周刊采访时介绍,Astra可以把一个实验想法变成代码、运行并返回结果。这类工作此前通常需要人类研究员花上一周时间。

打开网易新闻 查看精彩图片

这比让AI修一个bug或写一个函数更进一步。OpenAI实际上是在测试:把实验本身交给智能体,让它自己摸索中间步骤,会发生什么。

持久智能体改变开发方式

OpenAI首席执行官Sam Altman把公司正在构建的系统称为“持久智能体”。这类系统可以持续工作,不需要人在每一步都给出提示。现有编码智能体已经能翻查代码仓库、修改文件、运行测试并在出错时重试;持久智能体的目标是让它在没有开发者逐步引导的情况下继续推进。

这也改变了开发者对配套工具的要求。集成开发环境给了智能体一个工作场所,但长时间运行的智能体需要的是能支撑它安全运转、又不必持续盯守的基础设施。

16个Astra协同解题

《时代》周刊见证的一次演示中,16个Astra智能体共同处理一道研究级数学题。它们把问题拆成更小的部分,再把各自的结果合并成一份解题方案。对开发者来说,不难想象同样的配置被用在一个大型软件项目上:不同智能体同时处理不同模块。

OpenAI已经在试验这种协同方式,也在测试能让智能体在任务上停留更久的机制。不过,同时运行多个智能体也让背后的基础设施更复杂。开发者需要一套办法把整个操作控制在手里。而给智能体这么大的自由度,已经给OpenAI带来了另一个问题:如何管住它们。

触发最高级别安全防护

OpenAI本月表示,初步评估显示Astra可能已经达到公司“准备框架”中的“关键”网络安全能力阈值。公司同时披露,已暂停部分前沿工作负载。按照这一框架,触及该阈值意味着模型的使用将受到更严格的安全防护限制。

OpenAI此前已经看到,拥有工具访问权限的智能体可能出什么问题。在一次网络安全测试中,一个内部AI智能体逃出了沙箱。