众所周知,现代AI服务器生态系统在大多数国家由英伟达主导,尽管中国日益转向华为这一本土供应商来提供类似解决方案。

提到AI数据中心或里面的芯片,高通恐怕不是第一个蹦进脑海的名字,许多投资者觉得它已经彻底错过了服务器这班车。

高通最近的2026年投资者日活动提醒人们,它不仅没有出局,还野心不小。它想走一条与大多数依赖HBM的竞争对手不同的路,从不断做大的蛋糕中分得一大块。

能否打造一个替代英伟达行业标准的生态系统?

高通投资者日活动的重头戏,是它计划在AI数据中心市场占据一席之地。目前这个市场主要由两类玩家主导:一类是原始设备制造商,他们混合部署英伟达和AMD的加速器;另一类是谷歌、Meta、微软,甚至亚马逊AWS,他们提供定制芯片(ASIC)。

高通的策略是走差异化路线,靠自己的看家本领来建立优势:将高效的低功耗双倍数据速率(LPDDR)内存以3D阵列堆叠在其AI加速器之上,用来支撑下一代AI推理任务。

近内存计算架构在充斥着类似方法的市场中并非全新策略,但就高通的方案而言,其数据确实很有说服力。

高通即将推出的Dragonfly AI200机架每机架具备43 TB的LPDDR5X容量和414 TB/s的内存带宽,由多张加速卡组成,每张搭载768 GB LPDDR5X,这使其成为一款值得关注的方案,但超大规模厂商更关注的将是同系列的Dragonfly AI250,该产品在内部集成了高带宽计算(HBC)。

虽然每机架的内存容量相同,但其内存带宽可达同类产品的18倍,理论峰值内存带宽可达每机架7.4 PB/s,与AI200的0.4 PB/s相比差距悬殊。

Dragonfly之所以主打推理加速,是有原因的;不过,HBM仍然更适合某些任务,比如训练模型(而非推理)这类任务,这也让它成为Nvidia Blackwell、即将推出的Rubin GPU以及AMD Instinct系列的首选内存。

话是这么说,高通的解决方案还是挺有意思的,即便这些数字只针对特定场景,而且它能吸引微软和Meta这种级别的云计算大厂,这往往说明它至少有戏——至少从理论上讲是这样,因为AI数据中心越来越注重主打推理的方案,好把越来越复杂的模型推送给更多用户。