最新基准测试结果显示,Grok 4.6在Simbian网络防御基准上登顶,击败了包括GPT-5.6 Sol、GPT-5.5、Sonnet 4.6、GLM 5.2、DeepSeek 4 Pro、Kimi K3、Opus 4.8和Opus 4.7在内的多款主流AI模型。
这一成绩意味着Grok 4.6在网络防御这一细分能力上,当前表现优于榜单上其他竞品。Simbian基准主要考察模型在网络安全场景下的实战能力,覆盖威胁检测、漏洞分析等任务。
打开网易新闻 查看精彩图片
值得注意的是,本次排名中OpenAI的GPT-5.6 Sol位列其后,而Anthropic的Opus系列两款模型(4.8和4.7)均被Grok 4.6甩开。xAI在安全赛道的这一突破,或将对后续模型竞争格局产生影响。
热门跟贴