你以为卡死了我们的高端芯片,就能挡住我们超算登顶?说出来你可能不信,刚结束的ISC超算大会放榜,咱们全国产的灵晟超算直接把美国挤下来干到世界第一,而且从头到尾没用到英伟达一块GPU,这结果出来,不少人都直呼没想到。

打开网易新闻 查看精彩图片

这事发生在6月23日德国汉堡的ISC2026大会,榜单揭晓那一刻,好多盯着榜首的人都没猜到这个结果。这是咱们中国超算继2017年神威·太湖之光之后,时隔九年再站到全球性能之巅。灵晟的持续双精度浮点性能跑到了2.19EFlops,还是全球头一台持续性能突破二百亿亿次大关的超算系统。

现在全球超算圈的玩法,基本都是GPU加速当主流,这次TOP500榜单里,带GPU加速器的超算占比都升到55.4%了。但凡摸到E级门槛的超算,十有八九都用了AMD或者英伟达的加速芯片,这俩几乎成了行业默认的标配。灵晟偏不按这个套路来,它直接用了纯CPU设计,一块外来的GPU都没带。

灵晟总设计师、国家超算深圳中心主任卢宇彤在会上说了,他们首创了Online Acceleration全CPU架构,直接把AI矩阵加速单元嵌到了CPU内部,不用再折腾传统CPU加GPU的异构架构。说白了,原来数据要在CPU和GPU之间来回搬运,现在直接在芯片层面就把超算算力和AI算力融一块了,省去了很多不必要的损耗。图灵奖得主Jack Dongarra都夸,说灵晟让全世界看到了超算通向AI4Science新型架构的新方向。

打开网易新闻 查看精彩图片

最核心的芯片层,灵晟搭的是咱们自研的LX2处理器,基于ARM v9架构,每颗就集成了304个CPU核心,运行频率1.55GHz。整个系统一共由20480个计算节点构成,每个节点搭载两颗LX2处理器,算下来CPU核心总数快一千四百万个。LX2不光核心多,还创新性加入了多精度与矩阵加速能力,还集成了首颗国产HBM高带宽内存,内存带宽比传统CPU提升了十倍。

不光核心芯片是自己的,连互连网络和操作系统全都是国产货。灵晟用的是自主设计的灵启高速互连网络,能支持两百万个端口十万个节点的超大规模组网,这么大的规模都能稳稳Hold住。操作系统跑的是麒麟系统,从芯片到互连再到系统,全链路都是国产,真正实现了全栈自主可控。

打开网易新闻 查看精彩图片

好多人好奇,这么个超算算力到底强到什么地步?央视给过一个特别通俗的类比,灵晟工作一秒钟,相当于全球70亿人每人每秒完成一次基础运算,昼夜不停连续算上整整十年。这么一比,是不是一下子就对它的算力有概念了?

不光整体性能拿第一,在高性能共轭梯度基准测试里,灵晟也以22.00 HPCG-Petaflop/s的成绩排在第一。跟之前霸榜好久的美国超算El Capitan比,灵晟的实际计算效率达到80.4%,大幅领先对方CPU加GPU异构架构的64.1%。能效方面也不差,灵晟整机额定功耗是42.2MW,能效指标达到52.07 GFlops/W,还首创了100%全液冷散热计算机柜,在GREEN500能效榜单也排到了第五十位。

打开网易新闻 查看精彩图片

现在早就不是单纯堆芯片就能拿第一的时代了。超算的竞争早就变成了芯片、互连、存储、系统软件、散热整套体系的全链条较量。灵晟能赢,靠的就是每一环都不拉胯,不是靠堆某一块的料堆出来的第一。

别觉得灵晟就是为了冲榜造的样子货,它从部署完成之后就已经实打实干活了。现在它已经支撑了大气海洋模拟、工程仿真、材料科学、药物发现、脑科学、科学AI、大模型推理等一大堆领域的研究应用。在千万核心的大规模并行环境下,平均扩展效率能达到84.4%,是真真正正能承载科研和产业计算需求的生产级平台。

上一次中国超算登顶TOP500还是2017年的神威·太湖之光,之后这九年里,美国对华搞了多轮芯片出口管制,咱们国内之前的E级超算也很少参与排名、公开信息。这次灵晟选择面向世界公开拿第一,是头一回有美国之外的国家,完全不依赖AMD、英特尔、英伟达这些海外巨头的CPU和GPU,造出全球最强的超算系统。灵晟这次亮相,就是明明白白释放信号,国产超算已经有了不依赖海外芯片的硬实力,路怎么走我们自己说了算。

打开网易新闻 查看精彩图片

这次灵晟登顶,是咱们超算领域突破国外技术封锁,建成自主可控软硬件体系的关键跨越,给咱们科研突破、行业创新和产业高质量发展打好了最坚实的算力根基。在全球都走GPU加速路线、技术管控越来越紧的当下,咱们自己从芯片到系统攒出一整套国产体系,还跑出全球第一的成绩,就是对自主路线可行性最有力的证明。

参考资料:央视新闻 国产“灵晟”超级计算机登顶全球超算TOP500