OpenAI新模型GPT-6 Astra刚上线,就收到了一份高规格的"好评"。KIM在转发官方消息时直言,这款模型各方面能力都很突出,并配图展示了其在内部数据科学任务评测中的成绩——40.9%的高分。
这个分数放在内部评测语境下,含金量不低。要知道,数据科学任务向来是检验模型逻辑推理和工具调用能力的试金石,能拿到这个数字,说明GPT-6 Astra在复杂问题处理上确实有两把刷子。
打开网易新闻 查看精彩图片
同场竞技的还有谁?
KIM的引用内容还提到,Claude Fable 5.1在当天的表现同样强劲。两款模型同日亮相,火药味十足。不过KIM也透露了一个关键信息:GPT-6 Astra并非OpenAI今年发布的最后一款模型,言下之意,后面还有大招。
对于开发者来说,这轮模型竞赛的节奏明显在加快。头部玩家不再挤牙膏式更新,而是直接甩出高完成度的产品。接下来就看实际应用场景里,谁更能打了。
热门跟贴