今年春天的中东,战云压顶。美伊正打得不可开交,美军情报系统里突然炸了锅——一份标注为“机密”的报告在指挥链条中快速流转,核心结论只有一句话:一艘正在中东海域航行的中国商船,船上装着跟核武器项目有关的零部件。

这还了得?

打开网易新闻 查看精彩图片

消息传开之后,美军的动作快得像按了加速键。武装登船人员开始集结待命,军用飞机已经升空,拦截方案进入了最后的执行倒计时。按照CNN的说法,这已经不是纸上谈兵了,而是刀已经出了鞘,就差往下砍。、

行动前一秒,有人问了一句“这报告到底哪来的”

就在这节骨眼上,有美军官员决定回头翻翻这份报告的底账。这一翻不要紧,底裤都快给翻掉了。

打开网易新闻 查看精彩图片

报告确实是由一名特种作战司令部的分析师整出来的,格式标准,措辞专业,看着就像模像样。但问题的关键在于——这东西是拿AI聊天机器人“攒”出来的。那个聊天机器人在处理货物信息的时候,把船上的东西认错了,而且错得离谱,直接编出了一个“核武零部件”的结论。

一位知情人士用了一句话来总结这份报告的分量:“完全是假的,但差点把一场战争给点着了。”

还好,最后有人踩了刹车。但说实话,这个刹车踩得相当侥幸。

打开网易新闻 查看精彩图片

一个分析师、一个聊天机器人,怎么就把军机给忽悠上天了

回头捋一下这条“假情报生产线”,你会发现整件事荒唐到有点好笑,但笑完之后又让人后背发凉。

出事的分析师来自美军太平洋特种作战司令部,办公地点在夏威夷。他手头有一批关于中国商船货物清单的情报材料,正常情况下,他应该逐条对照原始数据,一项一项核实。但他没有这么干,而是直接把材料丢给了AI聊天机器人,让它去“交叉分析”。

打开网易新闻 查看精彩图片

问题就出在这儿。这个聊天机器人干的事情,是把公开渠道的信息和美军内部的机密信号情报揉在一起“综合判断”。听起来挺高级对吧?可它说到底就是个语言模型,它做的事情是根据已有文本生成一段看起来合理连贯的内容——至于这段内容是真是假,它自己根本不知道。用行话说,这叫“幻觉”。用大白话说,就是他在“一本正经地胡说八道”。

打开网易新闻 查看精彩图片

更要命的是接下来的操作。分析师拿到AI给出的结论之后,又用AI把它润色成了标准军情报告的格式,然后直接发进了军方指挥系统。一份AI瞎编的东西,套上了一个专业模板的壳子,就这么一路绿灯地穿过了层层关卡。

有熟悉美军AI系统的前高官说了一句大实话:“内部的工具,说白了就是商用产品换了个包装。”

打开网易新闻 查看精彩图片

33年前的“银河号”,换了种方式又差点来一遍

这件事让很多人一下子想起了1993年的“银河号”事件。

那年7月,美国同样是以“情报确凿”为由,指控中国“银河号”货轮向伊朗运送化学武器原料,出动军舰和飞机在公海上跟踪施压,把船逼停在达曼港接受检查。结果查了个底朝天,什么都没找到,美方情报全线翻车,但华盛顿方面连一句正式道歉都没给。

两次事件有一个让人很不舒服的共同点:都是先给中国商船扣上一顶“大规模杀伤性武器”的帽子,然后军事力量火速跟上。

打开网易新闻 查看精彩图片

当然,这次跟33年前还是有个本质区别——美军在动手之前刹住了车,没有真的登船。但话说回来,武装人员已经在待命了,军机已经在空中了,一艘正常航行的商船差一点就被全副武装的美军拦下来了。如果当时局势再紧张一点,如果指挥官的耐心再少一点,如果那个回头核查的人恰好没多问那一嘴——后果不堪设想。

AI“跑得快”,人类的脑子却跟不上了

这件事真正的可怕之处,不在于AI犯了一个错——AI犯错太正常了,这是它的本性。真正让人捏把汗的是,整条人工审核链条居然没有一个人拦住它。

打开网易新闻 查看精彩图片

底层分析师信了AI,中间经手的人看到红头文件和标准格式就默认“前面的环节肯定审过了”,上面的指挥官又以为“既然能送到我这儿,那肯定是层层核实过的”。你信我,我信他,他信文件格式,文件格式信AI——转了一圈,没有一个人回过头去看一眼最原始的证据。

美国国家标准与技术研究院(NIST)其实早就发过警告,说生成式AI最擅长的事情之一就是“自信满满地给出错误答案”,而且特别容易让人产生盲目的依赖。NIST在风险管理指南里反复强调,但凡用了AI生成的内容,里面的每一条出处都必须人工逐条核实。

打开网易新闻 查看精彩图片

但问题在于,五角大楼现在追求的就是一个字:快。

美军搞了一个叫GenAI.mil的内部AI平台,给大约300万国防部人员开放使用,截至目前已有约170万人注册。引入AI的算盘不难理解——现代战场上,卫星、雷达、无人机、监听系统每分钟都在往系统里灌数据,靠人一条条看根本看不过来,用机器压缩处理时间确实有道理。今年1月,国防部长赫格塞思还专门发布了《人工智能加速战略》,核心意思就一句话:放开手脚搞,别让官僚流程拖后腿。

打开网易新闻 查看精彩图片

可问题也跟着来了:速度越快,错误传得也越快。以前一份可疑情报,从分析员到主管到作战部门,中间有足够的时间和环节让人产生怀疑。现在AI几分钟就把分析、撰写、排版全干完了,留给人类“等等,这东西靠谱吗”的窗口,被压缩得越来越窄。一位消息人士说得很直白:“AI会让你更快地得出一个糟糕的想法。”

打开网易新闻 查看精彩图片

这不是AI第一次在美军手里闯祸了

今年3月,美军对伊朗的一次打击行动中,AI系统把一所伊朗小学标成了“军事基地”,还给了高优先级打击标记。结果呢?至少168人丧生,大部分是孩子。华盛顿邮报后来的调查直接点出了双重失误:情报本身就有问题,AI又跳过了交叉验证环节,两个错误叠在一起,酿成了无法挽回的悲剧。

打开网易新闻 查看精彩图片

这次中国商船没被登检,某种意义上是运气好——最后关头有人多问了一句。但这种“运气”,不能当成系统安全的保障。一份没有可靠证据支撑的报告,已经成功调动了真实的军机和武装人员,这个事实本身就说明问题不在最后一秒,而在整条流水线上。

打开网易新闻 查看精彩图片

出了问题,然后呢?

截至目前,五角大楼没有公布涉事商船的名称、航线、真实货物,也没有披露参与行动的具体部队和使用的是什么AI模型,更没有拿出一份完整的调查报告。整件事的信息来源主要是CNN对四名知情人士的采访,美国军方和太平洋司令部都没有回应置评请求。

打开网易新闻 查看精彩图片

与此同时,中美两国的安全专家正在讨论一件跟这件事高度相关的事情:给军事AI立规矩。他们提出的方案包括——涉及核武器使用的决策,AI绝对不能自己说了算;重大军事行动必须保留真正有效的人类监督;两国之间应该建立一条专门处理AI误判的沟通热线。

打开网易新闻 查看精彩图片

中国国防部此前也明确表过态:人工智能的军事应用应当“由人主导”,反对利用技术优势谋求军事霸权。

打开网易新闻 查看精彩图片

说白了,真正危险的从来不是机器说错话,而是机器一开口,人就急着把枪举起来了。

五角大楼如果不把这起事件查清楚——报告经过了哪些环节、哪一级批准了行动准备、最后是谁叫停的——那下一份格式漂亮、措辞专业的AI假报告,迟早还会被送到某个指挥官的桌上。到那时候,还有没有人愿意在最后一秒多问一嘴?

打开网易新闻 查看精彩图片

这个问题,比任何AI模型都更需要一个靠谱的答案。