来源| Tech星球
文| 华卫
今早,OpenAI 宣布,将开始推出其最新AI模型 GPT-6 Astra,称这是“多年研究和重大押注的成果”。该公司首席执行官Sam Altman表示,Astra 代表了“新的能力水平”,并改变了他自己的工作流程,将带来“创业精神、创造力、经济增长和科学发现的繁荣”。
不过,该模型不会立即上线,而是将分阶段推出,参与其基于申请的网络安全计划 Daybreak 的有限公司群体将率先获得访问权限。未来几天内,Astra 将通过 OpenAI API 和 Amazon Web Services向ChatGPT Plus、Pro、Business、Enterprise 计划的用户推出。
OpenAI 本周早些时候透露,Astra 是其首个达到内部“关键”网络安全阈值的模型,并表示计划限制对这些先进能力的访问。
同样价格,能吊打Claude Fable 5.1吗?
“你在电脑上能做的任何事,Astra 都能为你完成,而且很快。”OpenAI介绍,Astra 在 Agents' Last Exam、AutomationBench 和 ScreenSpot Pro 等针对各行各业计算机工作流程任务的基准测试中取得了最先进的成果。
并且,GPT-6 Astra 在 FrontierMath Tier 4、ARC-AGI 3 和 TerminalBench-4.0 上均达到最先进水平。GPT‑6 Astra 在科学发现方面也是一项重大进步,在 Terminal-Bench Science 0.1 和 HealthBench Pro 上均取得了最先进的性能。在 OSWorld 2.0 的离线子集上,Astra 的得分为 72.6%,每项任务耗时约 40 分钟,而 GPT-5.6 Sol 的得分为 65.7%,耗时约 75 分钟,每项任务耗时减少了约 47%。
此外,涉及困难或不可能完成且没有生产环境防护的任务时,GPT-5.6 Sol 有 48.2% 的时间超出了授权范围,而 Astra 从未发生这种情况。然而,当研究人员明确要求模型规避监控时,Astra 的书面推理比 Sol 更难追踪。OpenAI 表示,部分原因是 Astra 可以用更少的文字步骤解决更简单的问题,不过在更复杂的任务上,它仍然难以隐藏推理过程。
“Astra 是我们对齐程度最高的模型,在理解用户意图方面有显著提升”,OpenAI表示。
数学方面则更为有趣。OpenAI 称,Astra 参与了两项关于素数间隙的新发现。数学家 Julia Stadlmann 此前已将上界从 246 缩小至 240。在 Astra 参与后,该上界再次降至 186。该公司还提到另一个案例,Astra模型帮助改进了某一部分已有 80 多年未变的上界。
不过,OpenAI 的叙述中有一个重要的空白:它没有说明哪些是 Astra 独立得出的,哪些是研究人员的建议以及两者之间的工作如何交互。
值得一提的是,在 OpenAI 的内部测试中,在OpenAI自报的大多数基准测试中得分都高于Claude Fable 5.1。但标准版定价与其相同:每百万个输入token 10美元,每百万个输出token 50美元,缓存输入1美元、缓存写入12.5美元。不过,GPT-6 Astra还有快速模式,处理速度最高可达标准版的2.5倍,价格为标准版的2倍。
然而,在“人类最后的考试”测试中,Astra使用工具的得分为 57.2%,低于 Sol 的 65.0% 和 Claude Fable 5.1 的 63.8%。
此外,在第三方机构Artificial Analysis的横测中,Astra的分数更为复杂。在覆盖多维度的综合智能指数中,Astra 的评分为 61 分,与 GPT-5.6 Sol 相当,但比 Claude Fable 5.1 低约 5 分。在Coding Agent Index里,Astra拿到67分,比Sol高2分,但还是低于 Fable 5.1的70分。不过,Astra与Claude Opus 5和Fable 5处在相近区间,每项任务的成本还不到Fable 5的一半。
新推理技术引争议,被评“在玩火”
上个月,OpenAI 的两个模型逃逸隔离、访问了开放网络并侵入了 Hugging Face 的系统,此后 OpenAI 一直面临加强安全与防护措施的压力。事件发生后,OpenAI 暂时暂停了部分研究和训练工作,包括针对 Astra 的工作,尽管 Astra 并非涉事模型之一。
而在Astra发布前一天,OpenAI还在一篇博文中表示,Astra已被认定为“严重”网络安全风险,但确认仍将在采取安全措施的前提下继续推进发布。
OpenAI的“风险防范框架”追踪三个领域:生物/化学风险、网络安全风险和人工智能自我改进风险。
据悉,OpenAI 为 Astra 增加了额外的防护措施,并表示,相信这些防护措施“已充分降低发布可能带来的严重危害风险”。OpenAI 总裁Greg Brockman在记者简报会上称,“只有以安全为核心,人工智能才能真正造福人类,因此我们正在投入比以往更多的算力和精力用于安全、防护和对齐。”
同时,Brockman强调,新模型在发布前已与特朗普政府进行了正式的审查流程。
“还有很多工作要做,我认为仍有大量改进空间,但这一次确实有质的提升,在我看来,这才是关键所在,标志着人们可以将何种工作委托给 AI,以及 AI 如何赋能人类的真正转变。”Brockman也表示。
然而,新模型 Astra 当前还面临另一个安全争议,因为它使用了一种名为“不透明循环”(opaque recurrence)的特殊推理技术。该技术使其能够突破大多数推理模型所依赖的序贯思考模式,但会遮蔽一项重要的模型监控过程,即思维链(chain of thought),而思维链允许研究人员审计 AI 模型做出决策的方式和原因。
Astra 对该技术的使用似乎有限。OpenAI 首席科学家 Jakub Pachocki 表示:“从我们的第一个推理模型开始,OpenAI 就一直致力于保留和利用思维链监控。这是我们当前研究计划的核心目标。”
但这仍令许多 AI 安全专家感到不安。长期从事 AI 安全倡导的 Zvi Mowshowitz 发表看法道:“这项技术是在玩火,挑战了 OpenAI 和 Anthropic 一直努力确立的一条禁忌,即我们应尽力长期维持思维链的忠实性和可监控性,更密集地使用此类技术很可能会损害可监控性。”
Redwood Research 首席科学家 Ryan Greenblatt 在回应此消息的帖子中表示,不透明推理的扩展速度可能轻易超过传统的思维链推理,从而将所有推理过程从可见渠道中移除。Greenblatt 写道:“我最担心的是,从这里开始的自然演进将是扩大不透明推理的规模,直到模型完全或几乎完全在潜在空间中进行推理。我希望现在还不算太晚,能够避免最令人担忧的架构,也希望 OpenAI 能就此止步。”
上市对决中:Astra的使命与赌注
另外,GPT-6 Astra这款新模型的发布,正值 OpenAI 与 Anthropic 竞争白热化之际。
据外媒报道,两家公司均处于上市边缘。Anthropic 的企业估值近期飙升至 9650 亿美元,预计实际上市时可能达到该数字的两倍。而 OpenAI 在3月最近一轮融资中估值较低,为 8520 亿美元。
在即将进行IPO之际,外界正聚焦于这两家公司公司能否证明其技术优势。而自2022年推出 AI 聊天机器人服务“ChatGPT”以来,OpenAI 一直引领生成式 AI 市场,但今年被外界评价为已丧失技术领导地位,被 Anthropic 超越。
这次的新模型发布中,OpenAI 几乎在每个关键维度上都主动将 GPT-6 Astra 与 Anthropic 的旗舰模型 Claude Fable 5.1 进行了正面比较。这也折射出两家公司在 IPO 前夕的紧张对峙,每一次跑分对比,都像是在为即将到来的上市“决战”预热。
OpenAI 总裁 Greg Brockman 强调,Astra带来了“性能上的代际飞跃”,可被视为通用人工智能(AGI)。他表示,“AGI 的定义因人而异,但就我个人而言,我相信我们已经实现了。”
“根据在训练前监测的评估结果,我们认为从 Sol 到 Astra 的飞跃所代表的能力提升,比 Sol 到先前型号的飞跃所代表的能力提升更大。”OpenAI 研究员 Aidan Clark进一步表示,并将Astra 的开发情况描述为该公司规模最大的训练运行。
据 Clark 称,Astra 是第一个使用 OpenAI 公司 Stargate 基础设施上的 100000 个 DBU 进行预训练的 OpenAI 模型,也是第一个由先前的模型在监督下一个模型的训练中发挥重要作用的模型。
过去一年中,OpenAI 在竞争激烈的企业市场中大力争取商业客户,与 Anthropic 和谷歌等竞争对手展开角逐。OpenAI首席财务官Sarah Friar上个月对员工表示,其企业部门目前收入已超过消费业务。
最近,Friar告诉员工,OpenAI“将在 2027 年成为一家上市公司”,但也表示,如果“我们的业务继续出现拐点”,公司可能会更早上市。接下来,Astra的市场表现或将影响这一时间表。
热门跟贴