NVIDIA近日发布新博客文章,详细介绍了SpaceXAI将如何部署NVIDIA Vera CPU,以加速其下一代智能体AI应用。这是首款专为AI智能体打造的CPU,将进入全球最具雄心的AI部署场景之一。
智能体AI应用越来越依赖CPU来编排工具、执行代码、处理数据,并在模型调用之间运行模拟。SpaceXAI将利用Vera加速这些应用负载,帮助AI智能体更快行动,同时保持GPU持续满载、高效运转。
Vera CPU:为智能体AI而生
NVIDIA Vera是首款专为AI智能体打造的CPU,旨在加速模型推理周边的CPU密集型工作——从工具调用、代码执行到数据处理、编排与模拟。Vera搭载88个NVIDIA自研Olympus核心,配备NVIDIA Spatial Multithreading技术和高带宽LPDDR5X内存,带宽最高可达1.2TB/s。在智能体AI、强化学习和数据处理等工作负载中,Vera相比x86 CPU可实现最高1.8倍的任务完成速度提升。
“智能体AI需要一种新型计算系统——不仅要生成答案,还要采取行动。”NVIDIA超大规模与高性能计算副总裁Ian Buck表示,“Vera为AI智能体提供了实时行动的CPU性能——执行代码、处理数据、协调复杂任务。SpaceXAI正将这一架构从大规模AI工厂带到轨道计算的下一个前沿。”
SpaceXAI扩展AI基础设施
SpaceXAI计划在NVIDIA Vera Rubin平台上扩展其支撑Grok的AI基础设施,同时将优化后的Vera Rubin NVL72延伸至太空——搭载于其第一代Starmind卫星。
在大规模部署中,AI基础设施必须支撑严苛的训练、推理和推理负载,同时最大化性能、能效和利用率。NVIDIA Vera Rubin在计算、网络和软件层面协同设计,从整体上优化AI工厂。该平台整合了NVIDIA加速计算、NVLink互联技术、Spectrum-X以太网、BlueField数据处理单元及NVIDIA软件,形成一体化架构,旨在实现大规模高性能和高能效,同时降低每token成本。
“Vera为我们提供了强大的CPU性能和内存带宽,可以运行海量编排、代码和数据处理工作,同时让GPU专注于最擅长的事。”SpaceXAI总裁Mike Nicolls表示,“这意味着更高性能的AI智能体,以及每一瓦计算都能产出更多有效工作。”
随着SpaceXAI向吉瓦级计算能力扩展,Vera Rubin提供了一种通用架构,可高效扩展其下一代AI工厂——这是SpaceXAI计划从地面数据中心延伸至轨道计算的基础。
热门跟贴