OpenAI正在筹备一个叫Codex Replay的功能。它的核心动作很直接:把任意导入的对话线程拿来做任务执行测试。换句话说,过去那些已经聊完、跑完的历史会话,可以被重新拉出来,在受控环境里再走一遍。

这个功能不是简单地把聊天记录翻出来看。它要的是"重放"——让历史对话里的任务,在隔离的Codex实现里重新执行一次。

打开网易新闻 查看精彩图片

它到底怎么跑起来

从流出的功能描述看,Codex Replay的启动方式带着明显的工程味。它会在一个可用的回环端口上启动一个独立的Codex Replay控制器。在Codex Desktop和Codex CLI两个入口里,优先使用Codex内置的应用内浏览器,如果没有,就退回到系统浏览器

这个设计透露出一个信号:Replay不是塞进聊天窗口里的一个按钮,而是一个独立跑着的控制器。用户的操作界面在浏览器里,不在对话流里。

接下来是选择环节。用户可以挑一个或多个历史Claude线程,然后选择共享的Codex模型,启动它们各自的隔离实现。每个线程的历史状态和配置是分开检测的,需要的时候可以查看细节。

这里有个值得注意的细节:历史线程来自Claude,而执行用的是Codex模型。两套体系之间的迁移和重放,是这套功能要处理的核心问题。

并行跑,边跑边看

Replay支持多个重放会话并行运行。完成的对比结果可以单独看,也可以聚合看,而其他线程还在继续跑。默认选中的模型是GPT-5.6的Sol、Terra和Luna三个版本。

整个流程被拆成了几个阶段:选择、执行、验证、评估、结果。这些环节都留在浏览器控制器里,而不是走那种引导式的聊天工作流。

这个取舍挺有意思。聊天工作流适合一步步引导用户,但重放任务往往需要同时盯多个线程、对比多组结果,聊天窗口的线性结构反而成了束缚。把控制权交给浏览器控制器,等于承认这类任务需要的是仪表盘,不是对话框。

从功能描述里能读出的信息就这些。它解决的是"历史对话里的任务能不能被复现和验证"这个问题,方式是隔离执行加并行对比。至于实际跑起来效果如何、什么时候正式上线,目前没有更多消息。