当地时间8月12日,马斯克旗下 SpaceXAI 正式推出新一代大模型 Grok 4.6。本次版本迭代重点优化升级长程智能体运行、复杂编程处理与专业知识工作等核心能力,进一步完善模型在复杂专业场景下的落地表现。
根据 SpaceXAI 公布的测评数据,Grok 4.6 在多项权威榜单中取得亮眼成绩。在真实世界专业任务评测 GDPVal-AA v2 中,该模型取得1753 Elo 的分数,超越 Claude Fable 5 Max 的1741分与 GPT-5.6 Sol Max 的1728分。在 Artificial Analysis Intelligence Index 测评中,Grok 4.6 获得61分,与 GPT-5.6 Sol Max 得分持平,达到行业主流顶尖模型水准。
从整体测评结果来看,Grok 4.6 并未实现全维度领先,在部分专项测试中仍存在提升空间。其中在 DeepSWE 1.1、Terminal-Bench v3.0 等测评项目中,模型表现仍落后于 GPT-5.6 Sol Max。
在商业化应用层面,Grok 4.6 已开放相关使用渠道与明确定价标准。该模型 API 定价为每百万输入Token 2美元、每百万输出Token 6美元,目前已完成 Cursor、Grok Build、OpenRouter 等主流平台的接入,可供开发者及用户调用使用。
此外,DeepSeek API现已更新至DeepSeek-V4-Pro-0813版本。该模型为1.6T总参数(49B激活)MoE架构,支持1M上下文与最高384K输出。当前定价(元/百万tokens):输入缓存命中0.025、缓存未命中3、输出6。官方同步提示计划近期整体上调API定价,预计涨幅较大,具体方案以正式通知为准。
热门跟贴