新智元报道
OpenAI真的是一日一更啊!
就在刚刚,OpenAI「义父」Tibo亮出Day 5更新:「24小时在线Agent」dots,现在用手机就能创建了。
他直呼惊喜:此前已有那么多人通过网页和桌面端创建dot,现在,是时候把规模做大了!
已获得dots使用权限的用户,打开iOS或Android版ChatGPT,就能直接创建自己的dot。
更惊喜的是,dots给Codex派活,也更顺手了。
启动新任务、跟进旧线程、查找相关背景,再加上管理定时任务,这个私人助理越来越像个「派活大管家」。
掏出手机捏个Agent,再让它指挥Codex干活,这件事又少了一道门槛。
不用每次都切进Codex,你也能把工作交代下去。
手机捏个dot
开口就能派活
9月29日,OpenAI发布了「全天候个人AI智能体」dots。
它背后的模型,是GPT-6 Astra。
它和普通的ChatGPT对话完全不是一个概念。
dot有自己的云电脑和浏览器,可通过插件连接4000多个应用。
在授权范围内,它能持续推进任务,并主动汇报进展。
按OpenAI的说法,可以把dot看作自己的分身。
它会学习你的工作方式,发现需要关注的事项,并用自己的电脑推进你的项目。
但此前,要创建和配置dot,还得先用桌面App或网页。
想从零捏一个?那得先坐回电脑前。
而这一次,OpenAI直接把这个门槛给拆了。
现在,打开手机上的ChatGPT App,就能从创建开始,一路完成配置。
起名字、选外形、连接应用,全流程都能在手机上完成。
而这只是第一步。
dots指挥Codex
「派活大管家」来了
手机端只是入口变化,更关键的,是dot与Codex之间的配合又进了一步。
Codex负责具体的编程工作,dot则更像一个帮你组织任务的私人助理。
dot此前已经能向Codex派活。
这次补强的,是它们之间的衔接。
该沿用旧线程,还是另开一个?哪些背景需要带过去?dot能更好地判断。
之前讨论过的开发需求,可以接着已有线程继续做,相关背景也更容易找回来。
具体变化,可以拆成三件事:
查找相关背景
dot可以搜索ChatGPT对话,并调用已有Codex线程和自动化任务中的上下文。
之前讲过的需求、做过的尝试,能接着用,就少重复一遍背景。
更顺手的线程管理
另一个改进,是对新旧任务关系的判断。
它更擅长判断什么时候继续旧线程,什么时候另开一个,减少相关工作被拆散的情况。
跟进结果,管理定时任务
除了跟进编程任务,dot还能查看和编辑ChatGPT Work里的定时任务。想了解接下来的安排,或者调整周期性工作,都可以告诉它。
演示里,dot还会在Codex完成修改后继续发消息,要求开PR,再把待审查的结果汇总给用户。
这样一来,dot就像帮你统筹全局的「项目经理」,Codex则是负责具体编程工作的「工程师」。
而你,是发号施令的CEO。
流程也很直观:打开ChatGPT App,创建dot、交代目标,再由它把编程任务交给Codex。
你可以在手机上查看进度、处理需要批准的操作,也能随时补充要求。
想到一件要做的事,掏出手机,就能先把任务交代出去。
不仅如此,OpenAI还扔出了一批dots细节修复,其中包括:
浏览更快,滚动更流畅,少一些多余通知;代码块和附件的显示也更清楚了。
Outlook设置、套餐说明和失败后的重试也做了改进,网页端及语音通话中的企业版访问更可靠。
Codex秒猜下一句
真·读心术
比这条dots推文早92秒,Tibo还亮出了另一项Day 5更新:Composer Predictions(对话输入预测)。
简单来说,Codex有了「读心术」,能猜到你下一步想说什么了。
OpenAI放出的15秒短片,专挑开发者熟悉的瞬间。
让Codex做完一款游戏,输入框里就出现了下一步建议:「去把游戏装到我的Chromatic上。」
换到调整页面的场景,一句大写的「CENTER THE DIV」冒了出来,也就是把那个div居中。
还有开发者熟悉的收尾动作:「好,清理一下,再开个PR」。这些话都由Codex提前拟好,码农可以直接采用。
画面里还有两种建议:把论文讲得简短、通俗一点;保留当前设计,让它也能在手机上正常使用。
下一步可以是解释材料,也可以是继续改产品。
Codex根据对话预填下一条消息;按Tab接受后,仍由用户决定是否发送
还是熟悉的Tab键,现在连人给AI下的指令也能补全了。
Codex回答完一轮后,会根据当前对话,猜测你接下来可能发送的完整消息。
按下Tab,建议进入编辑框。你可以修改,再决定是否发送;觉得不对,也可以照常输入自己的话。那个替你说话的AI,仍得等你点头。
Claude Code此前已有类似的下一条提示建议
这里最有趣的变化,是输入框突然变得很像一个接得上话的同事。事情聊到哪里,下一步通常该做什么,甚至你平时怎么说话,都成了它预测的线索。
OpenAI员工Sharif Shameem给出了一个很抓人的说法。按他自己的使用感受,Codex能猜中他接下来要发的大约四分之一的消息。
他还转述一位共事研究者的评价,称预测「准确得吓人」。这里的四分之一是个人自述,没有公布样本量,不能当作产品准确率。
外部用户Ivan Ciraj也说,自己当天已经用了很多次,感觉像回到了按Tab补代码的年代,只不过体验被大幅加强了。
他最意外的是,之前根本没想过还能这样工作,甚至想向OpenAI里提出这个点子的人致敬。
Thomas Ricouard更直接:他大概接受了90%的建议。这是他的个人使用反馈。
目前,这项Beta功能面向符合条件、年满18岁的个人Pro用户,支持Codex桌面端的本地和SSH线程,以及GPT-6 Astra、GPT-6.1 Sol。
Tibo特意强调了另一个细节:预测包含在Pro套餐里,不消耗用量。
准确地说,免费的是生成建议这一步;把消息发出去,让Codex继续干活,仍按正常方式计量。
少敲几个字当然舒服。更微妙的变化是,AI还会建议下一步做什么。遇到熟悉的收尾操作,人只需确认;碰到方向性的选择,还是得自己拿主意。
OpenAI争的,是你开工的第一步
把两项更新放在一起,OpenAI想抢的位置就更清楚了。
dots接住目标、组织背景、委派任务;Codex则在一轮工作结束后,提前给出下一步建议。
OpenAI想占住的,是用户刚有一个目标、还没决定打开哪个工具的那一刻。
在不同工具之间找背景、分任务、接反馈,原本都要人来回奔忙。
如果这条链路能稳定跑通,从交代目标到检查结果,人就能少花些时间在工具之间来回切换。
到那时,开工的第一步,可能就变成一句:「这件事,交给我的dot。」
参考资料:
https://x.com/ChatGPT/status/2108636745915052037?s=20
https://x.com/OpenAIDevs/status/2108624138369929725?s=20
编辑:桃子 摩西
热门跟贴