大伙平时聊战机上用AI,是不是都只会关心算力够不够,能不能同时锁住一堆目标?没多少人会多想一层,AI给你的答案,万一本身就是错的呢?歼-36的工程师在公开技术交流上甩出的警告,戳破了很多人都没注意到的军事AI技术盲区,这事说小了是出bug,说大了真的可能出大问题。
大模型幻觉这个词,是2023年OpenAI公开说GPT缺陷的时候提出来的。就是模型没足够信息支撑的时候,也能编出一套逻辑通顺、其实全错的内容。放到军事场景里,这个毛病还变了好几种花样坑人。最常见的就是给不全的信息瞎补,雷达只抓到一点回波,AI直接凭着记忆给你安成某款装备。
还有上来就瞎猜对手意图,看几架飞机航向就直接说人要打哪。最坑的是把八竿子打不着的信号,硬拼成一套完整的“情报”,听起来像模像样全是错的。这几种错在实验室静态测试里根本发现不了,真进入实战化对抗才会曝问题。
放到歼-36上,这个问题就变得特别尖锐。它的整体架构,和咱们之前的五代机歼-20本质上不是一回事。歼-20那一代还是飞行员说了算,AI只是帮忙打打下手分类目标。
歼-36从2024年12月首飞画面到2025年一系列试飞就能看出来,它带了大面积分布式孔径系统,机腹弹舱旁还有专门指挥无人机的天线阵。一个飞行员要同时管好几架忠诚僚机,还要处理预警机、卫星、地面站一堆情报。人脑物理上扛不住这么多信息,只能把大半判断权交给机上的AI。AI要是瞎编故事,飞行员最后就只能给它盖章认了。
真正让工程师睡不着觉的,是电磁对抗环境下的诱导性幻觉。2025年美军在红旗演习中就测过一个新概念,叫认知欺骗弹药,专门发精心设计的假雷达信号,引对手的AI出错。它最可怕的地方不是把你AI搞瘫,是让AI信心满满地犯大错。
以前遇着电子干扰,飞行员一看屏幕全是雪花就知道被干扰了,马上切目视或者备用频段。现在被骗出来的是一套完整合理的假态势图,飞行员反而会按着这个假情况下真命令。歼-36团队公开聊这个事,其实就是提醒国内,别低估这种新型威胁。
中国军工解决这个问题的路子,和硅谷走的完全不是一条道。硅谷那边就认大模型参数越大越好,语料越多越好,说白了就是用数量掩盖质量问题。放到军事领域这条路根本走不通,战场上容错率是零,错一次就是灭顶之灾。
国内国防科技大学、航空工业沈阳所还有中电科这些单位,已经整出来一套军用AI的数据分级标准。把训练用的语料分成实测、演训、仿真、开源四个等级,各等级权重完全不一样。开源数据只用在常识层面的预训练,涉及目标识别、战术判断这些核心能力,全靠封闭内网里的实测数据反复微调。这个办法看起来笨,效率也不高,但胜在可靠性可控。
看看太平洋对岸的进展,就能看出两边路子的差别。美国空军2025年11月官宣NGAD项目由波音牵头,配套的无人僚机也进入第二阶段开发。但2026年3月美国国会预算办公室的评估报告直接说了,NGAD的软件生态非常依赖硅谷商业大模型的军事化改造,本身有没法预测的行为偏差。
兰德公司同年4月的跟进研究也点出了这个问题,美国现在连一套完整的军用AI审查机制都没建起来。多个厂商各自训练模型,彼此之间的语料还相互污染,乱得没边。我们这边是国家队集中攻关,哪怕进度比商业竞争慢一点,至少语料来源可控,AI的行为边界也清晰。
现在这场AI可靠性的较量,刚好赶上台海局势最紧绷的时候。2026年以来,赖清德接着之前的“台独”路线一路走到黑,5月在就职两周年讲话里再抛分裂言论,6月又借着过境的名义窜访美国相关地区。台防务部门还跟着美方推动所谓不对称战力建设,采购了一大堆小型无人机、便携式反舰导弹。
这类低成本、高密度、易伪装的装备大量部署,刚好是最容易触发AI误判的类型。商用无人机和武装型号的雷达特征差不了多少,伪装成渔船的侦察艇和真渔船在红外图像上几乎一模一样。解放军东部战区常态化战巡已经达到每周多批次多方向的强度,哪怕错一次,都会被境外势力拿来放大炒作,后果不容小觑。
从这次工程师的公开表态,也能看出中国军工文化的一点微妙变化。前几年装备研发的信息透明度不高,很多技术细节都要靠外界从图片里一点点抠了分析。这两年从2025年下半年开始,各大主机厂的技术骨干开始越来越频繁在公开渠道聊具体的工程问题,也不藏着掖着谈缺陷、谈短板、谈风险控制。
这种敞亮其实就是行业自信提升的表现,只有真真正正掌握核心技术的团队,才敢公开讨论技术的边界在哪。有些外国厂商动辄宣称自己的AI系统永不出错,这种话在真正的工程师听来,才是最不专业的吹牛。大家都是玩技术的,谁不知道哪有完美的东西,吹得越满水越深。
这事未来怎么走,主要看几个方向的变化。头一个是算力,我们2025年底已经建好若干个军事专用的高性能计算集群,给封闭式模型训练打好了物质基础。再一个是实测数据积累,随着各战区常态化演训的深化,实战化数据的规模会持续扩大。还有就是行业标准,2026年年内要是能形成一套国家层面的军用AI评估规范,我们就有可能在这个新兴领域拿到规则制定权。
歼-36预计在2027年前后完成主要科目的试飞,那位工程师警告过的所有风险点,届时都要用实际测试数据来回答,是好是坏一试便知。这场关于机器可信度的较量,某种意义上比隐身、比超音速巡航,更能定义下一代空战的胜负。飞行员坐进歼-36的座舱那一刻,他要相信的不只是身下的发动机、眼前的屏幕,还有那个用无数行代码写成的数字副驾驶。
让这个副驾驶学会说不知道,学会诚实报告自己的置信度,学会在数据不足时主动请示人类,这些看似简单的品质,恰恰是通用大模型最缺乏、也最难训练的能力。歼-36工程师把这个问题摆到桌面上,中国航空工业能不能给出比对手更好的答案,未来两三年就见分晓。毕竟真刀真枪的技术较量,从来都是勇者敢露拙,智者见真章。
参考资料:人民网 中国新一代军机技术发展观察
热门跟贴