关键词

AI,Claude

事件核心:Anthropic 今日正式扩容其网络安全验证计划(CVP),向受审核的专业安全团队开放降低安全对齐过滤与封锁机制的 Claude 模型权限(包含 Claude Opus 5.5、Sonnet 5.5 等)。官方披露,其“玻璃翼计划(Project Glasswing)”在过去数月内通过大模型共挖出超过 12.9 万个验证漏洞,其中超 3.3 万个为高危或严重级别。然而第三方独立评估显示,AI 自动挖掘出的海量缺陷中仅 0.67% 在真实世界具备在野可利用性,AI 挖洞狂欢背后正在引发新的安全工程审视。

打开网易新闻 查看精彩图片

三级权限体系:破除大模型网络安全护栏

在常规商业对话场景下,主流大模型一旦识别到逆向工程、反汇编、PoC 构造或 Exploit 编写意图,就会立即触发敏感词拦截并拒答。Anthropic 此次设立的网络安全验证计划(Cyber Verification Program,CVP)设立了三个准入梯度:

  • 1. 防御访问级(Defense Access):

    专供安全应急响应、恶意软件逆向工程、二进制漏洞机理分析与验证。在基准测试中仍会拦截部分高攻击倾向指令。

  • 2. 红队测试级(Red Team Access):

    向合规授权的渗透测试与实战红队开放,解除所有自动化拦截机制,实测任务完成率与零拦截裸机模型完全持平(50 项攻防任务完成 34 项)。

  • 3. 专属特权级(Specialized Access):

    具备最低程度的安全约束,仅定向授权极少数合规机构用于核心底层模型安全性极限摸底。

挖出12.9万漏洞背后:虚假繁荣还是实战突围?

Anthropic 在公告中称,基于 Claude 构建的 Project Glasswing 自动化引擎在 2026 年 4 月至 7 月期间已挖掘并验证了 129,000 个软件漏洞,随后在开源代码扫描中又补充发现了 5,500 个,其中评级为 Critical / High 的严重漏洞多达 3.3 万个。

独立数据泼冷水:在野利用率仅 0.67%

安全研究机构 VulnCheck 跟踪分析了 Anthropic 及 Glasswing 归属的 300 个核心 CVE 漏洞发现:真正被黑客组织在野利用(Exploited in the wild)的仅有 2 个(占比仅 0.67%),分别为 Ghost CMS 的 SQL 注入漏洞(CVE-2026-26980)以及 Rejetto HTTP 文件服务器的会话伪造漏洞(CVE-2026-61500)。绝大多数 AI 标记的所谓“严重漏洞”,要么处于不可达的冷分支,要么触发条件极为严苛,不具备真正的攻击杠杆。

⚠️ 修补悖论:44% 的 AI 修复代码埋下新雷

AI 虽然显著拉低了静态代码缺陷排查门槛,但伴随而来的“补丁自动化”却潜藏剧毒风险。安全机构 Veracode 最新发布的生成式 AI 代码安全报告给出了警示数据:

  • 补丁二次引入缺陷:

    在测试的 AI 代码生成与自动修复任务中,高达44%的 AI 修复方案直接引入了新的高危安全缺陷。

  • 安全通过率停滞:

    各主流模型生成的安全代码平均通过率仅为 56%,与两年前相比几乎零改善。大模型进入研发流水线后,劣质补丁反而稀释了代码库的整体安全性。

️ 总结:双刃工具不可直接用于无人值守合规

Anthropic 向专业白帽开放高级模型是一把锋利的双刃剑——它既能让安全防守方几秒钟还原复杂的恶意代码控制流,也可能被灰色产业链用于批量自动化扫描与 PoC 武器化。在实际研发管理中,绝对禁止将 AI 挖掘结果和 AI 生成的补丁直接合入生产主干,必须依托人工白帽和动态测试环境进行上下文可达性验证。

打开网易新闻 查看精彩图片

安全圈

打开网易新闻 查看精彩图片

网罗圈内热点 专注网络安全

实时资讯一手掌握!

好看你就分享 有用就点个赞

支持「安全圈」就点个三连吧!