Anthropic前沿红队对智谱开源模型GLM-5.3做了一次系统测评,结论是:它已经具备可与Claude相当的前沿自主漏洞利用能力。

更值得琢磨的是Anthropic给出的另一个判断——GLM-5.3是首个达到前沿水平、且几乎不设防的开源模型。对标对象被明确写成了Claude Mythos Preview。

“前沿”加“不设防”意味着什么

在Anthropic的表述里,这两个词是绑在一起的。前沿水平指向端到端自主漏洞利用能力,不设防指向获取门槛——能力到了顶尖,拿到的难度却很低。

推文转述这一结论时抛出了三个疑问:这究竟是安全提醒,是呼吁管制,还是变相宣传?

三种可能指向完全不同的动机,但推文没有给出答案,只是把问题摆了出来。

争议落在开源的安全边界上

这场讨论的核心并不在GLM-5.3本身,而在开放前沿模型的安全边界。一个能力比肩顶尖闭源模型的开源模型,如果几乎不设防,责任该由谁承担、边界该划在哪里,业界一直没有共识。

Anthropic的测评把这个问题重新推到台前。至于这份评价背后是提醒、管制呼吁还是宣传,推文留下的疑问,本身也是这场争议的一部分。