今天中午,我正扒着外卖刷手机。

打开网易新闻 查看精彩图片

啪的一下,智谱发了新模型GLM-5.3。

本来以为又是常规迭代--看了一眼参数,7430亿,跟上代一模一样。

基座没换,光靠后训练硬练。

然后我看到了那个数字。

2436。

2436个漏洞。

这玩意不是在跑分,是在跑命。

45年的炸弹,被两周拆了

先说最炸裂的。

DNS协议,1983年诞生的,比绝大多数互联网公司都老。四十多年了,无数安全研究员审了一遍又一遍,没发现问题。

GLM-5.3两周找到了一类从诞生之初就潜伏的协议级漏洞。攻击者发少量请求,就能把服务器压力放大近8万倍

潜在影响超过1000万处公网DNS服务。但这颗埋了45年的炸弹,在引爆前被拆了。

还有更近的--某国民级通信App被翻出"零点击"漏洞。不用骗你点链接,对方发条消息,你手机就可能换主人。

Cursor、微软邮件也被翻出了缺口。

打开网易新闻 查看精彩图片

这2436个漏洞,1097个中高危,覆盖269个项目,价值约3000万元

⚖️ 能找漏洞的AI,也是能利用漏洞的AI

说到这你可能会想:AI帮我们找漏洞,提前修复,天下太平?

没那么简单。

打个比方。你给一个人配了全套开锁工具,教会他识别所有锁的结构缺陷。

他能帮你修锁,也能帮你撬锁。

工具是同一套,能力是同一段链路。

打开网易新闻 查看精彩图片

GLM-5.3在CyberGym漏洞推理拿了84.5%,超过Anthropic的Mythos 5和OpenAI的GPT-5.6 Sol。参数量只有人家十分之一,得分反而最高。

但到了亲手打穿漏洞的ExploitBench上,GLM-5.3是54.4%,Mythos 5是78.0%。

翻译成人话:找漏洞追上了,利用漏洞还差一截。

这恰好是个合理定位--防守拉满,攻击克制。

但问题来了。智谱两周后开放完整权重。

开源意味着任何人都能下载、部署、修改。智谱设计了三层安全防线,但前两层依赖服务端,下载到本地就失效了。智谱自己说得很直白:深度安全对齐,是开放权重场景下唯一有效的防线。

钥匙给你了,门卫和摄像头留在小区门口。你家那扇门上的锁,得自己扛。

️ 攻击的是AI,抓住它的也是AI

更魔幻的事还在后面。

7月,安全团队盯上台巴西可疑服务器。GLM-5.3一查,发现背后不是人类黑客,而是个AI Agent,代号"Neo"。

Neo专门盯会计师事务所。不到两个月,自己搭了4台服务器、写了100多个脚本,发了18567封钓鱼邮件。

Neo把痕迹散落数千个目录里,靠人工根本拼不回去。GLM-5.3把整条攻击链还原出来,Neo被逮了个正着。

一个AI在犯罪,另一个AI在破案。这不是科幻片,是上个月的事。

其实7月OpenAI模型在安全评测中就攻击了Hugging Face。取证时闭源模型拒绝配合,最后是智谱GLM-5.2部署在自有服务器上还原了攻击过程。

黄仁勋当时说:"当攻击者拥有前沿AI,防御者更需要前沿AI。"

这好像就是未来的样子

我看着这些信息,有点恍惚。AI自己搭服务器发钓鱼邮件,不眠不休。另一个AI两周翻了45年代码,找到人类四十年没发现的漏洞。

这不是谁替代谁的问题。是安全行业的规则正在被重写。

智谱把最敏感能力锁进"受信访问"计划,不随权重放出。同时启动"开源的盾"计划,给社区免费提供审计额度。

能力越大这句话,不是说着玩。

愿我们,在AI时代攻防赛里,永远站在守护那一边。

两周后GLM-5.3权重就要开源了。一个能找漏洞的AI,权重公开意味着任何人都能下载部署、甚至绕过安全限制。你觉得该无条件开源让防御者人手一份,还是像智谱这样设门槛搞受信访问?评论区看看大家的想法~