一款权重开放、成本低廉的大语言模型,正在把自动化漏洞挖掘的门槛拉到消费级硬件上。GLM 5.3-flash 可以在价格低于 10,000 美元的 Apple M5 Mac Studio 上下载并运行,吞吐量约为每秒 45 tokens。这意味着个人持续运行该模型,在技术上已经没有任何障碍。
基准测试暴露了什么
文章引用了两组关键分数:CyberGym 为 84.5%,ExploitBench 为 54.4%。这两个数字展示出该模型接近前沿模型的漏洞利用能力。换句话说,它发现并利用真实安全漏洞的水平,已经足以引发对自动化攻击的担忧。
更麻烦的是安全缓解措施可以被精准移除。经过「消融」处理的模型不再拒绝恶意请求,在 Harmbench-320 测试中得分为 0%——完全不拒绝。这类模型愿意提供黑客攻击或制造管状炸弹的指令,等于把最后一道安全屏障拆掉了。
为什么这次威胁被放大
部署便利性和快速补丁的缺乏,是文章强调的两个放大器。只要有一点积蓄,几乎任何人都可以日以继夜地持续运行 GLM 5.3-flash。而防御方的补丁速度,远远跟不上攻击者调用模型的速度。漏洞窗口正在缩小,但缩小的方向对防御者并不友好。
文章给出的判断相当直接:GLM 5.3-flash 非常擅长这些任务,以至于人类在这些任务中的参与几乎可以忽略不计。这句话的潜台词是,过去需要熟练攻击者花时间完成的工作,现在可以被自动化地、持续地执行。
各方应该做什么
文章提出了一组分层建议。政府层面,应资助安全工程,激励频繁的渗透测试,并要求及时修复。公司层面,应使用前沿模型进行主动测试,自动化补丁部署,并执行严格的凭据范围限制。开源基金会则应投资于形式验证、模糊测试和供应链安全。
这些措施并非新概念,但文章的核心提醒在于执行速度。防御者手里有工具,难点从来不是没有手段,而是能不能在漏洞被大规模利用之前完成部署。文章最后强调,我们需要修复整个行业的漏洞,以免措手不及。
热门跟贴