文|陆弃

9月8日下午1时许,英国空中交通管制服务提供商Nats发生技术故障,大量航班无法正常起飞。到当天晚上8时左右,英国各机场累计取消航班已经超过1000架次,希思罗、盖特威克等主要机场均受到影响。Nats下午1时46分首次确认正在调查问题,直到4时40分才表示已经找到飞行处理系统故障并实施修复。系统虽然重新启动,但航班积压和连锁延误仍持续到深夜,英国航空甚至预计影响将延续至9月9日。这已经是三年多来第三次出现类似空管系统事件,问题显然不能再简单归结为一次偶发故障。

打开网易新闻 查看精彩图片

航空系统最特殊的地方,在于它几乎没有容错空间。铁路晚点,列车可以暂时停在车站;公路拥堵,车辆还能够寻找其他道路;但在高密度空域中,每一架飞机的航线、高度、起降时间都必须经过精确协调。一个核心处理系统出现问题,受到影响的就不只是某个机场,而可能迅速传导到整个区域航空网络。

这次故障就是如此。原本集中在英国主要机场的离港问题,很快蔓延到英格兰南部大部分地区的进港航班。易捷航空取消137架次,英国航空取消111架次,其他欧洲航司同样受到波及。瑞安航空称超过6.5万名乘客遭遇延误,受影响旅客总数达到数十万人。

现代航空网络高度依赖空管系统,因此核心节点一旦失灵,航空公司即使飞机、机组和机场全部正常,也无法自行解决问题。企业承担航班取消、改签和旅客安置的直接成本,旅客则承担时间损失和行程中断,而故障却发生在航空公司难以控制的基础设施环节。真正值得追问的,也就不只是这一次故障为什么发生,而是为什么类似事件出现之后,整个系统仍然如此容易受到冲击。

Nats强调,这次故障与2023年和2025年的两次事件并非同一类型,并称相关情况“相对罕见”。从单次事件来看,这种解释并非没有道理,不同故障确实可能具有不同技术原因。但对于承担英国空中交通管制核心职责的机构而言,公众真正关心的并不是三次故障是否属于同一种技术问题,而是系统有没有足够的冗余、备份和应急切换能力。

打开网易新闻 查看精彩图片

此次从故障发生到Nats宣布找到问题并实施修复,已经过去近四个小时。系统恢复后,大量航班积压又需要持续消化,影响甚至延续至第二天。这意味着需要审视的已经不只是故障点本身,还包括故障发生后的处置能力:主系统出现问题时,备用系统能否迅速接管?人工操作能够维持多大规模的运行?机场和航空公司能否及时获得统一、准确的信息?如果这些环节没有形成足够的缓冲能力,那么一次技术故障就可能迅速演变成整个航空网络的运营危机。这也是航空公司要求改革的根本原因。

瑞安航空已经要求Nats首席执行官辞职,认为旅客和航空公司再次为系统失败承担代价。维兹航空则直接质疑这一关键国家基础设施提供商是否有能力履行职责。航空公司当然存在自身利益考量,因为每一次大规模取消都意味着巨额损失,但它们的批评也触及一个重要事实:空中交通管制并不是普通商业服务,而是现代经济运行的重要公共基础设施。

英国是欧洲重要航空枢纽,伦敦又拥有全球最繁忙的航空市场之一。大量商务往来、旅游和国际转机依赖英国机场。一次持续数小时的系统故障,影响的因此不仅是机场大厅里的旅客,还会波及酒店、旅游、会议、货运以及整个欧洲航线网络。瑞安航空所称超过6.5万名乘客遭遇延误,正说明这种影响已经远远超出技术部门自身的范围。

打开网易新闻 查看精彩图片

更值得警惕的是,航空业正在进入一个对空域管理要求越来越高的阶段。航班数量增长、机场容量有限、无人机活动增加以及航空网络高度国际化,都要求空管系统拥有更强的实时处理能力。如果基础设施投资、系统升级和应急能力没有同步提高,运行压力越大,单点故障造成的外溢影响就可能越严重。

因此,改革不能简单等同于“换一个负责人”。如果最终只是把责任归结给个人,而没有重新审视系统架构、技术更新、人员配置、备份机制和监管方式,那么下一次故障仍然可能发生。真正有效的改革,应当把一次事故转化为制度性检查,明确关键系统的冗余标准、故障切换时间和跨机构应急机制,并让责任链条能够经受公开检验。

9月8日的故障已经让英国航空网络付出了现实代价。超过1000架次航班取消、数十万旅客受到影响,混乱甚至延续到第二天。对于旅客来说,他们需要的不是一句“深表歉意”,而是一个更可靠的答案:为什么一个关键系统出现故障后,整个航空网络会承受如此大的冲击?

一个国家的基础设施水平,并不只体现在机场规模和大型工程上,也体现在那些平时几乎无人注意的控制系统能否经受住意外。空管系统看不见,却决定着成千上万架飞机能否安全、有序运行。