OpenAI一次性公开了722篇数学手稿。这些手稿并非出自人类数学家之手,而是由一个未公开的内部推理模型完成。消息证实了此前流传的猜测:这家公司手里握着一个不对外发布的模型,正在用它啃硬核数学。
手稿覆盖了372个成果家族。为了得到这批结果,OpenAI对多达4000个研究问题进行了长效测验。测验不是跑一遍就完,而是让模型在推理阶段持续投入算力,直到产出可用的数学成果。
3小时算力换一篇手稿
每项成果在标准设置中,平均耗费 ChatGPT Pro 高达3小时的计算资源。这个数字指向一个正在成型的趋势:推理阶段的算力增强,已经从实验室概念走进科研实际落地。过去衡量模型能力看训练规模,现在看的是它在思考上愿意花多少算力。
值得注意的是,生成这批手稿的模型仍处于非公开状态。OpenAI没有说明它叫什么、参数多大、何时对外开放。外界能看到的只有结果——722篇手稿和372个成果家族,以及背后那台不肯露面的推理引擎。
思考算力进入科研场景
把3小时算力压在一道数学问题上,成本并不低。但换回的是成批的硬核数学成就,这笔账在科研场景里算得过来。思考算力在科学探索上的效率,正在被这类批量产出验证。
对研究者来说,信号很直接:能长时间深度推理的模型,已经开始参与真正的数学工作。而对OpenAI来说,公开手稿但不公开模型,等于把能力展示和产品发布拆成了两件事。
热门跟贴