美国的顶尖模型似乎已经被中国的模型卷的不行了。
OpenAI 宣布,他们决定即日起起对GPT-5.6系列模型进行降价!
具体来说是这样:
GPT-5.6 Luna (中杯)降80%,输入价格降至每百万Token 0.20美元,输出1.20美元。
GPT-5.6 Terra (大杯)降20%,输入价格降至2美元,输出12美元。
GPT-5.6 Sol(超大杯)标准价格不变,但API新增了一个 Fast mode:智能水平不变,速度最高达到标准模式的2.5倍,价格为2倍。
OpenAI还将ChatGPT和Codex CLI中的Auto-review(自动审查)模型从GPT-5.4升级到GPT-5.6 Luna。
结合新价格,OpenAI 预计自动审阅的成本将下降约10倍,这对于代理工作流来说更加的经济高效。
为什么突然能降这么狠?
OpenAI 自己给的解释是:他们让 GPT-5.6 Sol 优化了自己。
他们把 Sol 放进 Codex,去分析真实生产流量、优化全球负载均衡,并用 Triton 和 Gluon 自主重写了生产环境的 GPU 内核,端到端推理成本直接降 20%。
随后它又为自己的投机解码草稿模型设计并跑了数百次实验,训练中途遇到硬件故障还自己进去处理,Token 生成效率提升 15% 以上。
再往上一层,Codex 的 Agent 框架把对话历史改成只能往后追加、工具顺序固定,把 prompt 缓存命中率拉满,几十轮的 Agent 循环里省下的都是硬钱。
用模型来优化模型这种递归(或者复利式)进化,已经成为当前 AI 公司的标配,这种方式导致的进化加速度会远高于之前。
我们已经看到这不仅让模型能力提升更快(比如 Kimi K3 就用自己进化),连着模型相关的效率、成本也开始得到优化。
没有人说过用 AI 来优化 AI,仅限于技术层面,现在终于得到验证了。
这才是 AI 真正有趣,但也有点可怕的地方,你觉得呢?