今年「超节点」有多火

你自己来逛逛WAIC就知道了

打开网易新闻 查看精彩图片

路过各大展位的时候

超节点是气场拉满、最吸引眼球的

打开网易新闻 查看精彩图片

那么问题来了

超节点VS普通集群到底啥区别?

超节点VS普通集群到底啥区别?

我们先拿【一个机柜】为单位讲

1个普通服务器机柜

是把很多台服务器塞进一个柜子

常见的,塞8台八卡GPU服务器

好比一栋楼里住8户人家,每户8口人

一家人沟通不串门,但跟别家就要串门

打开网易新闻 查看精彩图片

1个超节点

整个机柜被设计成一台完整的超级服务器

里面也放64张GPU

却相当于一个超级大平层

只住1个大户人家,64口人

所有人沟通不用串门,直接面对面交流

打开网易新闻 查看精彩图片

所以,超节点从设计之初

就是按大平层思路,而不是单元楼

GPU/NPU加速卡 + CPU + 高速互联交换芯片 + 大容量内存 + 网络设备 + 液冷系统 + 供电系统

按一整套协同系统来规划设计

如果上升到【以集群为单位】

多个超节点可以通过Scale up方式组网

形成一个更大的跨楼大平层

打开网易新闻 查看精彩图片

超节点更适合扛AI大活

一家人齐芯协力,效率拉满

这也是当下国产超节点火爆的原因

接下来就有人要问了

国产超节点哪家强?

国产超节点哪家强?

这款超节点必然占据一席

它就是↓

百度天池256卡超节点

震撼亮相WAIC,让我们一睹真容

打开网易新闻 查看精彩图片
打开网易新闻 查看精彩图片

接下来如果你继续追问

这天池256超节点,到底强在哪儿?

我可以用一句话来概括

⬇️

强在全国产化

从芯片到协议到软件到整机

每一层都做到全栈自研

第一强是自研国产芯

第一强是自研国产芯

天池256卡超节点

由256张昆仑芯全互联而成

打开网易新闻 查看精彩图片

昆仑芯,来头可不小

基于自研XPU-P架构

打开网易新闻 查看精彩图片

第二强是算力调度平台

第二强是算力调度平台

光有强悍的算力芯还不够

一个超大规模的AI集群

如何调用和激发几万颗芯的潜能?

靠的是百舸AI计算平台

好比芯片算力调度指挥中心

打开网易新闻 查看精彩图片

昆仑芯 +百舸,软硬协同

把芯片、网络、调度和框架彻底打通

构成了一套完整AI Infra

万卡集群跑起来,稳得一匹

打开网易新闻 查看精彩图片

第三强是整体架构设计

第三强是整体架构设计

围绕计算、网络、内存、存储、散热

重新设计了一套超级精密的架构

整机架构、全链路全自研

打开网易新闻 查看精彩图片

①计算:构建纯国产异构算力池

过去,国产芯片最大难题,是怎么协同作战

打开网易新闻 查看精彩图片

天池256支持CPU+GPU+DPU异构协同

把不同国产芯片纳入一个算力资源池

打开网易新闻 查看精彩图片

对于用户而言

自由选择芯片品牌,灵活搭配

尤其推理和智能体业务爆发的时代

更加需要GPU和CPU异构计算

打开网易新闻 查看精彩图片

天池256还兼容X86生态

极大降低迁移成本

已有业务,无需大改造

就可以轻松跑起来

打开网易新闻 查看精彩图片

tips:智能体大爆发时代,CPU深度参与控制、调度、集群管理和智能体运行,软件迁移是否平滑,直接影响AI集群落地效率。

②网络:全链路自研高速互联

超节点的高速互联是全国产化难点

一整套高速链路器件,国产化难度极高

打开网易新闻 查看精彩图片
打开网易新闻 查看精彩图片

百度选择了自己干,全链路自研

自研XPU-Link 互联协议

互联协议是超节点的灵魂

百度从零写起,一行行代码

写出了中国芯自己的通信语言

打开网易新闻 查看精彩图片

通过自研XPU-Link互联协议

构建国内首个可编程的Scale-Up通信网络

网络时延低到2μs,带宽有效率高达77%

能对标国际顶尖方案

打开网易新闻 查看精彩图片

自研Scale-up互联架构

这相当于超节点的AI高速路网

路(架构)不行,256卡就是一盘散沙

天池256采用最新自研HPN5.0架构

达到业界顶流水准

打开网易新闻 查看精彩图片

自研超高带宽交换机

从交换架构设计到软件协议栈

只为大模型通信做专属优化

打开网易新闻 查看精彩图片

自研国内首个Cable Tray铜缆互连

高速互连物理链路

是国产化里最难啃的骨头之一

天池超节点,成功拿下

打开网易新闻 查看精彩图片

这套自研高速互联组合拳下来

超节点实现了超高带宽、超低时延

端到端时延优化50%,做到亚秒级响应

用户体感:飙车!

打开网易新闻 查看精彩图片

③能耗散热:自研国产化液冷CDU

这是国内首个 Side-Car CDU

整机柜全液冷设计,PUE降低至1.15

打开网易新闻 查看精彩图片

打开网易新闻 查看精彩图片

④存储:内存四层+存储加速架构设计

百度通过四级内存体系

缓解内存墙问题

打开网易新闻 查看精彩图片

通过近存计算+存内计算

让大规模数据处理速度更快

打开网易新闻 查看精彩图片

再回头看看

天池256是一款深度国产化的产品

计算、网络、存储、散热、软件五大系统

以及整体结构设计

均实现了深度国产化

打开网易新闻 查看精彩图片

当然,这还不是最难的

全栈国产化超节点的最大难度

是让所有国产部件

在一个系统里高效协同,性能不打折

打开网易新闻 查看精彩图片

但这件事,天池256做到了

百度为了干成最强国产超节点

也是拼了

打开网易新闻 查看精彩图片

每一个短板,都自己补齐

每一个难题,都自己突破

最终我们看到的是

一台真正协同工作的AI超级服务器

一台效率超级高的智算怪兽

打开网易新闻 查看精彩图片

天池256卡超节点今年6月正式上市

已完成主流模型的适配

在性能测试上,更是优秀

吞吐性能、推理效率、端到端时延

都得到了前所未有的提升

打开网易新闻 查看精彩图片

当然,更难得是

大量实战验证

打开网易新闻 查看精彩图片

①百度自身核心业务的验证

百度用全国产昆仑芯集群完成了

大模型文心5.1重要版本的训练

打开网易新闻 查看精彩图片

2025年至今,短短1年时间

已交付多个昆仑芯万卡集群

从万卡到三万卡,投入生产

打开网易新闻 查看精彩图片

而且这些万卡级的集群

有效训练率达97%

硬件不空转,利用率拉满

打开网易新闻 查看精彩图片

②来自头部客户的认可

来看一组公开的中标信息吧

足已证明一切

部分中标项目

  • ①招商银行AI芯片资源项目,昆仑芯支持银行核心业务场景落地大模型;
  • ②南方电网AI算力服务器项目,2.3亿元;
  • ③中国移动AI通用计算设备集采,超10亿元;
  • ④中国联通济南大模型创新工场项目,8.37亿元;
  • ⑤中国联通济南智算一体机项目,2.9亿元;

打开网易新闻 查看精彩图片

⬇️

WAIC逛了这两天,最大的感受是

超节点很热,国产化需求更热

当超节点真正开始落地

用户开始寻找能用、好用的国产超节点时

百度天池超节点,给了市场更优的选择

打开网易新闻 查看精彩图片