在 Connect 2026 上,华为把 AI 基础设施的下一步讲得很直接:围绕「超节点 + 集群」展开,目标是让百万卡规模的算力,能稳稳托住万亿参数级别的模型。
这套思路里有两个关键词。一个是 Ascend 960 超节点,另一个是 NPO 技术。它们被放在一起,指向同一个方向——把算力堆到足够大,同时让集群真正跑得动。
打开网易新闻 查看精彩图片
为什么是「硅基黑土地」
华为给这套基础设施起了个名字,叫「硅基黑土地」。黑土地的特点是肥沃、能承载、能长出东西。放在算力语境里,意思就是底层要足够厚实,上层的大模型才有生长的空间。
百万卡规模不是一个小数字。它意味着集群的组网、调度、能耗、稳定性,每一项都要重新设计。万亿参数模型对算力的胃口,也决定了基础设施不能只靠单点性能,而要靠整体协同。
超节点加集群,解决的是什么
单卡再强,也扛不住万亿参数的训练。华为选择的路子,是用超节点把一批算力单元紧密连在一起,再用集群把多个超节点串起来,形成一张能扩展的网。
NPO 技术出现在这个环节里,承担的是连接和协同的角色。它要处理的,是规模上去之后,节点之间怎么高效对话、怎么不让通信拖慢整体节奏。
这套组合拳的逻辑并不复杂:先把单点做扎实,再把规模做上去,最后让规模真正可用。百万卡和万亿参数,一个是硬指标,一个是硬需求,中间靠的就是「超节点 + 集群」这座桥。
热门跟贴