打开网易新闻 查看精彩图片

核心发布:2026年8月13日,据9to5Mac报道,OpenAI正在预览一种以极高速运行其最强模型GPT-5.6的新方式。该公司宣布,全新的“Ultrafast”服务层级在运行GPT-5.6 Sol时,速度最高可比标准处理模式快14倍。

技术支撑:Ultrafast模式由Cerebras提供算力支持,将率先通过OpenAI API推出。该模式每秒最多可生成750个输出Token,旨在将前沿的AI性能引入到对延迟要求极高的工作场景中。

模型背景:OpenAI曾于2026年6月发布GPT-5.6 Sol,并同时推出了主打平衡的Terra和侧重速度的Luna模型。整个模型家族已于7月向公众广泛开放,用户可通过ChatGPT、Codex及API进行访问。

应用场景:OpenAI表示,Ultrafast模式将支持语音、客户支持、商务交易、开发者代理、金融研究和安全响应等实时或接近生产环境的任务。在实际应用中,OpenAI开发团队已利用该模式在系统事件期间分析日志与追踪信息,并将过去需要彻夜运行的研究周期压缩至工作日内进行多次迭代。

访问权限:在评估极速运行对实际产品的影响并扩大容量期间,该服务目前仅限部分特定客户群体使用。有相关需求的企业可通过分享自身工作负载、延迟要求及预期使用量等信息,加入Ultrafast等待名单。

参考链接:
https://9to5mac.com/2026/08/13/openai-previews-ultrafast-gpt-5-6-sol-running-up-to-14-times-faster/