Grok 4.6 在最新发布的 CursorBench 3.2 基准测试中拿下 70.8% 的成绩,登顶榜首。更值得注意的是它的成本:单任务仅 $2.81

对比一下同榜单的对手:Fable 5 Max 得分 70.5%,单任务成本 $17.32,Grok 4.6 便宜了约 6 倍;Opus 5 Max 得分 70.0%,成本 $8.23,Grok 4.6 也便宜了近 3 倍。

打开网易新闻 查看精彩图片

分数接近,成本差出一个量级

三款模型在得分上差距不到 1 个百分点,但成本差距明显。对高频调用 API 的开发者来说,这个数字可能比分数本身更关键。

xAI 同时透露,完整版 Grok 4.7 将在数周后发布,参数规模 2.1T,各方面优于 4.6(1.5T),仅服务速度略慢,但 token 效率更高。