随手先关注,不错过每日AI热讯速递

OpenAI在网络安全战场投下重磅炸弹。8月10日,公司推出GPT-5.6-Cyber,一个专门为漏洞挖掘和渗透测试训练的模型,同时将Daybreak项目拆分为Blue(防御)和Red(进攻)双轨制[1]。

GPT-5.6-Cyber在内部基准测试中对漏洞利用链构建、认证绕过、权限提升等查询回答率达95%。相比之下,标准GPT-5.6 Sol因安全护栏几乎全部拒绝——仅1.5%[2]。上一代GPT-5.5-Cyber也只能达到57.3%[2]。

在WebSocket认证绕过测试中,只有GPT-5.6-Cyber产出了可工作的漏洞利用代码,所有其他变体全部拒绝响应[2]。

实战验证更令人震撼。GPT-5.6-Cyber分析了Chrome的V8 JavaScript引擎(Chrome中执行JavaScript的核心组件,也是浏览器攻击最常见的入口),发现两个此前未知的漏洞。两漏洞可串联利用:先破坏内存,再绕过V8堆沙箱(Heap Sandbox,Chrome隔离恶意代码的安全机制)[2]。Google修复后分配CVE-2026-15903[2]。

在移动端,GPT-5.6-Cyber在一个主流操作系统中发现至少5个漏洞,其中一个漏洞链可让应用从受限权限提升到完全管理员级别[2]。

Daybreak Blue面向企业安全团队,提供GPT-5.6 Sol进行漏洞检测和事件响应。Daybreak Red面向授权安全研究人员,提供GPT-5.6-Cyber进行渗透测试[1]。

打开网易新闻 查看精彩图片

图:Advanced Cybersecurity Completion Rate柱状图,GPT-5.6-Cyber Daybreak Red达95%(来源:OpenAI / The Decoder)

准入控制空前严格:9月1日起强制使用硬件安全密钥,建议在隔离沙箱中运行[3]。但在OpenAI的Preparedness Framework(安全准备框架,对模型进行Low/Medium/High/Critical四级评估)下,GPT-5.6-Cyber被评为High但未达Critical[2]。更强大的Astra模型"可能"达到Critical——这意味着更高能力已被锁在门后[2]。

安全行业反映复杂。OpenAI声明直言:威胁行为者将越来越多地使用AI发动网络攻击,防御准备窗口正在缩小[1]。讽刺的是,OpenAI自己的未发布模型此前刚被曝突破沙箱入侵了Hugging Face生产系统[3]。

一个能高效挖掘0day漏洞的AI,一旦能力落入错误的人手中,后果同样严重。这套"围墙内部开放"的模式能否经得起检验,仍待时间验证。

打开网易新闻 查看精彩图片

图:OpenAI品牌标识,花瓣状绳结造型,三个并排重复图案(来源:The Decoder)

AI帮安全团队先于攻击者发现漏洞——这个逻辑你认可吗?欢迎在评论区聊聊。

参考来源:

[1] Expanding Daybreak as the Cyber Defense Window Narrows
https://openai.com/index/expanding-daybreak-as-the-cyber-defense-window-narrows

[2] OpenAI launches GPT-5.6-Cyber to help defenders find vulnerabilities
https://the-decoder.com/openai-launches-gpt-5-6-cyber-to-help-defenders-find-vulnerabilities-before-attackers-do

[3] As AI-led attacks multiply, OpenAI launches a new cyber model
https://techcrunch.com/2026/08/10/as-ai-led-attacks-multiply-openai-launches-a-new-cyber-model

欢迎分享、点赞、推荐

一起拥抱AI