按住下方图标,点击小程序

免费领取AI学习资料、精选提示词

今天凌晨1点,OpenAI给顶配模型GPT-5.6 Sol增加了极速推理,速度暴涨14倍,每秒最高750个token

打开网易新闻 查看精彩图片

要想实现这么高的推理效率,光靠软件、算法优化很难实现,这次OpenAI和一家硬件公司Cerebras合作开发出来的。

Cerebras这家公司是专门做那种超大晶圆级芯片,整个晶圆不切割,直接当一块巨型处理器用,相当于给模型修了一条双向八车道的高速公路。

打开网易新闻 查看精彩图片

GPT-5.6 Sol这种极速模式用来写文案,总结点内容那就太浪费了,而是能深度融入企业各类紧急、动态变化的工作场景,实实在在解决各类高频业务痛点。

比如在企业运维和故障处理场景中,服务器和核心系统突发故障时,每一秒的延误都可能带来巨大损失。以往工程师需要手动翻阅日志、核对代码变动、梳理问题反馈,耗时费力还容易遗漏关键信息。

现在借助极速模式,AI可以在故障持续的过程中,实时梳理各类数据、快速锁定故障根源,同步辅助梳理修复思路,大幅缩短整个故障处理的周期。

金融行业的数据分析和风险防控也能迎来全面升级。金融市场瞬息万变,交易数据、市场信号每一秒都在更新,传统AI分析滞后性严重,很难跟上市场节奏。

极速模式可以实时捕捉市场动态、核查交易数据、甄别异常操作,在市场状态还在变动的过程中完成分析判断,让金融研究和风控工作从滞后复盘,变成实时跟进。

大家日常接触的客服和语音通话场景,体验也会迎来质的飞跃。以往智能客服面对复杂问题时,常常需要卡顿加载、反复调取数据,打断正常的沟通节奏。

升级之后,哪怕是需要多步骤、多系统联动核查的复杂客诉问题,AI也能全程同步应答,对话流畅自然,完全贴合真人沟通的节奏。

打开网易新闻 查看精彩图片

对于科研和实验研发行业来说,这次更新更是解决了一大痛点。过去很多复杂的模型实验、数据推演,运算量极大,只能夜间批量运行,研发人员需要等到第二天才能查看结果,迭代效率极低。

现在依托极速模式,整套实验流程可以变成实时交互式操作,大家可以随时验证想法、查看结果、调整方案,一天之内就能完成多轮实验迭代,研发节奏直接提速一个档次。

OpenAI官方也做了一个很直观的对比测试,用完全相同的文字指令,让极速版和标准版的GPT5.6 Sol分别搭建3D仓储仿真模拟器。

极速版全程快速响应、同步输出,两者的成品质量几乎无差别,唯独速度差距极其明显。

目前这个极速模式还处于限量内测阶段,OpenAI正在和各行各业的首批企业客户深度磨合,持续挖掘高速AI的落地价值,同时根据真实的生产使用反馈,不断优化功能细节。

如果是对AI响应速度、智能精度都有极高要求的企业,都可以提前预约登记,后续开放扩容时就能第一时间体验。

AI 实操交流群找一群同路小伙伴一起进步

企业、高校及渠道合作

打开网易新闻 查看精彩图片