攻击者武器化一个新漏洞,平均只要5天。而一家典型组织打上补丁,中位数要43天。这两个数字摆在一起,中间那段空窗期,就是安全团队每天在赌的东西。

一份新发布的免费指南,把这段差距拆开来讲:自主AI代理(agentic pentesting,自主渗透测试)正在怎么填这个坑,以及在把它指向生产环境之前,安全负责人必须先要到哪些承诺。

打开网易新闻 查看精彩图片

渗透测试的年度节奏已经过期

渗透测试这个动作,十年几乎没变过。但攻击者早就不按年度时间表工作了。面对一个以天为单位移动的对手,一年一次的渗透、一份长长的PDF报告、一份到手就已经过期的修复清单,都太慢了。

2026年的行业数据把这件事说得很清楚。Verizon的2026年DBIR报告基于22000多起已确认的泄露事件,标记出一个转折点:漏洞利用已经超过被盗凭证,成为最常见的入侵入口。

修复端却在往反方向走。已知被利用漏洞的补丁中位时间从32天升到43天;CISA KEV目录里真正被打上补丁的漏洞占比,从38%降到26%。

攻击者以天计,防守者以周计。Google Mandiant的遥测数据显示,平均利用时间约5天。Cobalt的2026年渗透测试状况报告显示,解决一个高风险发现的中位时间是39天,表现最好和最差的团队之间差了25倍。一个按43天时钟走的防守方,面对5天就动手的对手,与其说是在管理风险,不如说是在事后记录风险。

AI同时打破了攻防两侧的时间点模型。攻击者用AI更快地发现并武器化漏洞;你自己的开发者用AI交付代码的速度,超过任何人类团队能测试的速度。Cobalt还发现,AI/LLM应用携带高风险发现的比例,是传统应用的2.7倍

一年拍一张快照,覆盖十分之一的资产,还要几周后才交付,对手却以5天为单位移动。这个缺口,就是自主渗透测试要填的东西。

能力已经被验证,不是预测

素材给出的几个数字,指向同一件事:这套能力不是纸上推演。

  • 2025年,一个自主系统登上了HackerOne美国区排行榜榜首(XBOW)。
  • 经同行评审的代理,在无人协助的情况下利用了87%的one-day漏洞(Fang等,2024)。
  • 程序化测试让团队在三天内修复严重问题的可能性提升4.5倍(Cobalt,2026)。

漏洞利用现在是正门。它发起了31%泄露事件(Verizon DBIR 2026),是第一大初始访问途径;而年度渗透测试让大约90%的资产从未被测试过。

经济账也偏向采用。一次约1.8万美元的人工渗透(行业估算),对应的是444万美元的平均泄露成本(IBM,2025)。

它是在你生产环境里的一个AI代理

指南给出的态度很直接:把它当成生产环境里的一个AI代理来要求,标准不能松。要么给出可证明的覆盖范围、一个独立验证器、爆炸半径护栏和审计轨迹,要么不成交。

换句话说,采购的不是一次服务,而是一个会自己动手的代理。它跑在你的生产环境里,能碰什么、碰不到什么,必须事先说清楚。

指南还用一个常见攻击链演示了差异:认证账户区里的一个IDOR。攻击者登录一个普通账户,修改资料更新请求里的account_id,就能触达别人的数据。同一个漏洞,在年度渗透和自主代理两种模式下,会走向四种不同的结果。