打开网易新闻 查看精彩图片

新智元报道

打开网易新闻 查看精彩图片

OpenAI真的是一日一更啊!

就在刚刚,OpenAI「义父」Tibo亮出Day 5更新:「24小时在线Agent」dots,现在用手机就能创建了。

他直呼惊喜:此前已有那么多人通过网页和桌面端创建dot,现在,是时候把规模做大了!

打开网易新闻 查看精彩图片

已获得dots使用权限的用户,打开iOS或Android版ChatGPT,就能直接创建自己的dot。

更惊喜的是,dots给Codex派活,也更顺手了。

启动新任务、跟进旧线程、查找相关背景,再加上管理定时任务,这个私人助理越来越像个「派活大管家」。

掏出手机捏个Agent,再让它指挥Codex干活,这件事又少了一道门槛。

不用每次都切进Codex,你也能把工作交代下去。

打开网易新闻 查看精彩图片

手机捏个dot

开口就能派活

9月29日,OpenAI发布了「全天候个人AI智能体」dots。

它背后的模型,是GPT-6 Astra。

打开网易新闻 查看精彩图片

它和普通的ChatGPT对话完全不是一个概念。

dot有自己的云电脑和浏览器,可通过插件连接4000多个应用。

在授权范围内,它能持续推进任务,并主动汇报进展。

按OpenAI的说法,可以把dot看作自己的分身。

它会学习你的工作方式,发现需要关注的事项,并用自己的电脑推进你的项目。

但此前,要创建和配置dot,还得先用桌面App或网页。

想从零捏一个?那得先坐回电脑前。

而这一次,OpenAI直接把这个门槛给拆了。

现在,打开手机上的ChatGPT App,就能从创建开始,一路完成配置。

打开网易新闻 查看精彩图片

起名字、选外形、连接应用,全流程都能在手机上完成。

而这只是第一步。

dots指挥Codex

「派活大管家」来了

手机端只是入口变化,更关键的,是dot与Codex之间的配合又进了一步。

打开网易新闻 查看精彩图片

Codex负责具体的编程工作,dot则更像一个帮你组织任务的私人助理。

dot此前已经能向Codex派活。

这次补强的,是它们之间的衔接。

该沿用旧线程,还是另开一个?哪些背景需要带过去?dot能更好地判断。

打开网易新闻 查看精彩图片

之前讨论过的开发需求,可以接着已有线程继续做,相关背景也更容易找回来。

具体变化,可以拆成三件事:

  • 查找相关背景

dot可以搜索ChatGPT对话,并调用已有Codex线程和自动化任务中的上下文。

之前讲过的需求、做过的尝试,能接着用,就少重复一遍背景。

  • 更顺手的线程管理

另一个改进,是对新旧任务关系的判断。

它更擅长判断什么时候继续旧线程,什么时候另开一个,减少相关工作被拆散的情况。

  • 跟进结果,管理定时任务

除了跟进编程任务,dot还能查看和编辑ChatGPT Work里的定时任务。想了解接下来的安排,或者调整周期性工作,都可以告诉它。

演示里,dot还会在Codex完成修改后继续发消息,要求开PR,再把待审查的结果汇总给用户。

打开网易新闻 查看精彩图片

这样一来,dot就像帮你统筹全局的「项目经理」,Codex则是负责具体编程工作的「工程师」。

而你,是发号施令的CEO。

流程也很直观:打开ChatGPT App,创建dot、交代目标,再由它把编程任务交给Codex。

你可以在手机上查看进度、处理需要批准的操作,也能随时补充要求。

想到一件要做的事,掏出手机,就能先把任务交代出去。

不仅如此,OpenAI还扔出了一批dots细节修复,其中包括:

浏览更快,滚动更流畅,少一些多余通知;代码块和附件的显示也更清楚了。

Outlook设置、套餐说明和失败后的重试也做了改进,网页端及语音通话中的企业版访问更可靠。

打开网易新闻 查看精彩图片

Codex秒猜下一句

真·读心术

比这条dots推文早92秒,Tibo还亮出了另一项Day 5更新:Composer Predictions(对话输入预测)。

简单来说,Codex有了「读心术」,能猜到你下一步想说什么了。

打开网易新闻 查看精彩图片

OpenAI放出的15秒短片,专挑开发者熟悉的瞬间。

让Codex做完一款游戏,输入框里就出现了下一步建议:「去把游戏装到我的Chromatic上。」

换到调整页面的场景,一句大写的「CENTER THE DIV」冒了出来,也就是把那个div居中。

还有开发者熟悉的收尾动作:「好,清理一下,再开个PR」。这些话都由Codex提前拟好,码农可以直接采用。

画面里还有两种建议:把论文讲得简短、通俗一点;保留当前设计,让它也能在手机上正常使用。

下一步可以是解释材料,也可以是继续改产品。

打开网易新闻 查看精彩图片

Codex根据对话预填下一条消息;按Tab接受后,仍由用户决定是否发送

还是熟悉的Tab键,现在连人给AI下的指令也能补全了。

Codex回答完一轮后,会根据当前对话,猜测你接下来可能发送的完整消息。

打开网易新闻 查看精彩图片

按下Tab,建议进入编辑框。你可以修改,再决定是否发送;觉得不对,也可以照常输入自己的话。那个替你说话的AI,仍得等你点头。

打开网易新闻 查看精彩图片

Claude Code此前已有类似的下一条提示建议

这里最有趣的变化,是输入框突然变得很像一个接得上话的同事。事情聊到哪里,下一步通常该做什么,甚至你平时怎么说话,都成了它预测的线索。

OpenAI员工Sharif Shameem给出了一个很抓人的说法。按他自己的使用感受,Codex能猜中他接下来要发的大约四分之一的消息。

他还转述一位共事研究者的评价,称预测「准确得吓人」。这里的四分之一是个人自述,没有公布样本量,不能当作产品准确率。

打开网易新闻 查看精彩图片

外部用户Ivan Ciraj也说,自己当天已经用了很多次,感觉像回到了按Tab补代码的年代,只不过体验被大幅加强了。

他最意外的是,之前根本没想过还能这样工作,甚至想向OpenAI里提出这个点子的人致敬。

打开网易新闻 查看精彩图片

Thomas Ricouard更直接:他大概接受了90%的建议。这是他的个人使用反馈。

打开网易新闻 查看精彩图片

目前,这项Beta功能面向符合条件、年满18岁的个人Pro用户,支持Codex桌面端的本地和SSH线程,以及GPT-6 Astra、GPT-6.1 Sol。

Tibo特意强调了另一个细节:预测包含在Pro套餐里,不消耗用量。

准确地说,免费的是生成建议这一步;把消息发出去,让Codex继续干活,仍按正常方式计量。

少敲几个字当然舒服。更微妙的变化是,AI还会建议下一步做什么。遇到熟悉的收尾操作,人只需确认;碰到方向性的选择,还是得自己拿主意。

OpenAI争的,是你开工的第一步

把两项更新放在一起,OpenAI想抢的位置就更清楚了。

dots接住目标、组织背景、委派任务;Codex则在一轮工作结束后,提前给出下一步建议。

OpenAI想占住的,是用户刚有一个目标、还没决定打开哪个工具的那一刻。

在不同工具之间找背景、分任务、接反馈,原本都要人来回奔忙。

如果这条链路能稳定跑通,从交代目标到检查结果,人就能少花些时间在工具之间来回切换。

到那时,开工的第一步,可能就变成一句:「这件事,交给我的dot。」

参考资料:

https://x.com/ChatGPT/status/2108636745915052037?s=20

https://x.com/OpenAIDevs/status/2108624138369929725?s=20

编辑:桃子 摩西