“攻击者现在拥有越来越强大的能力,在庞大的代码库中搜索,只需要找到一处弱点就能潜入。”周三,微软宣布在MDASH多智能体漏洞识别与修复套件中推出MAI-Cyber-1-Flash。这套组合系统以当前顶尖模型一半的成本,交出了世界级的性能答卷。

AI的进展令人震惊,它同时也释放出了新一代的网络威胁。安全攻防已经彻底改变——偶尔扫描一次、最终找个时间打补丁的旧模式,现在已经过时。微软给出的答案是:先构建出色的网络模型,帮助所有人加固运行世界的软件。

打开网易新闻 查看精彩图片

被选中承担这个任务的是MAI-Cyber-1-Flash。它的专长是在复杂的代码库中找出那些棘手的漏洞,已深度集成到MDASH中,由业界最顶级的网络安全专家打磨,并在全球最大的安全资产区经历了严苛考验。这套组合拳在CyberGym基准测试中交出的成绩单是:击败Mythos、Gemini和GPT。

CyberGym是评估系统如何在大型代码库中推理并发现真实漏洞的黄金标准基准。在这个测试场上,MAI-Cyber-1-Flash与MDASH的统一系统得分达到96%,高出Mythos整整12个百分点。

在真实的攻防现场,安全是一项不间断的任务。考虑到入站攻击的庞大数量,Token成本已成为防守方的实际约束。MAI-Cyber-1-Flash的设计目标就是高效处理高达90%的任务,使MDASH能将舰队中更大、更昂贵的模型——目前是GPT-5.4——留到另外10%真正需要的超难任务上。

这套经过精心调优的多模型系统,得益于独有的、丰富的历史训练数据,其结果是一个醒目的数字:相比MDASH目前的最佳配置——GPT 5.4加上5.4 mini加上5.3 codex——成本直降50%。它确保用户在每一项任务上,都能以最优的价格调用最合适的模型。

AI修复软件漏洞已成为关键的安全工作流,但安全从业者自己还有大量工作要完成。因此,微软同日还推出了智能体安全系统Perception,在MDASH中为各种安全工作流提供多组智能体,持续监控、打补丁、关闭新的威胁向量。不久后,Perception也会在软件漏洞工作之外,将MAI-Cyber-1-Flash用在更多的安全工作流上。

在当前的新环境中,从发现新漏洞到实时处理,这一速度至关重要。微软的总结是:三件事在今天至关重要——模型、数据与集成套件。将这三个要素联合优化,才能确保客户获得独一无二的强大安全防护能力。