全新AI基础设施融合了领先的计算能力、网络和开放软件,为大规模AI提供机架级性能。
关键要点:
•AMD推出AMD Helios机架级解决方案,这一全新机架级AI基础设施旨在为前沿AI、大规模推理和基础模型训练而设计。
•该平台将AMD Instinct MI455X GPU、第六代AMD EPYC服务器CPU、AMD Pensando网络和AMD ROCm软件整合到统一的机架级架构中。
•AMD Helios可提供百亿亿次级AI性能、业界领先的内存容量和带宽和从单个机架到吉瓦级AI集群的可扩展性。
•AMD Helios支持开放式AI基础架构,具备UALink™ over Ethernet (UALoE)、基于标准的以太网、AMD ROCm软件和内置的机架级安全功能。
内容概要:
AMD推出了AMD Helios机架级解决方案,这一开放式AI基础设施平台集成了AMD Instinct MI455X GPU、第六代AMD EPYC服务器CPU、AMD Pensando网络和AMD ROCm软件,以支持前沿AI、大规模推理和基础模型训练。该平台还可提供百亿亿次级AI性能,可从单个机架扩展至吉瓦级AI集群,同时获得更多AI计算、内存容量、内存带宽和每美元token。
常见问题解答
•何为AMD Helios机架级解决方案?AMD Helios是专为前沿AI、大规模推理和基础模型训练而设计的机架级AI基础设施平台。
•AMD Helios都包含哪些技术?
AMD Helios将AMD Instinct MI455X GPU、第六代AMD EPYC服务器CPU、AMD ROCm软件和AMD Pensando网络整合到统一的机架级架构中。
•AMD为何推出AMD Helios?
AMD推出AMD Helios旨在帮助客户部署开放且可扩展的AI基础设施,并能够在机架和集群规模上提供高性能、高效率且高性价比的AI。
•AMD Helios的部署规模能扩展至多大?
AMD Helios可从单个机架扩展至吉瓦级AI集群。
有哪些值得关注的新动态?今日在Advancing AI 2026峰会上,AMD推出了AMD Helios机架级解决方案,这一全新机架级AI基础设施旨在为前沿AI、大规模推理和基础模型训练而设计。AMD Helios将AMD Instinct MI455X GPU、第六代AMD EPYC服务器CPU、AMD ROCm软件和AMD Pensando网络整合到统一的机架级架构中,可提供百亿亿次级(exaflop-class)AI性能、业界领先的内存容量和带宽和卓越的可扩展性。
为什么这项进展值得关注?随着对AI工厂和前沿AI的需求不断增长,客户需要能够从单一机架高效扩展至大型吉瓦级(gigawatt-scale)AI集群,同时还能最大化性能、每瓦性能和每token成本的基础设施。AMD Helios则提供了集成式的机架构建模块,既能简化部署,又可以为下一代AI基础设施提供所需的计算、网络和开放软件基础。AMD Helios机架级AI解决方案在低、中、高三种交互水平下均展现出更高的token吞吐性能,且从设计之初就采用了开放式架构。该解决方案旨在帮助客户在部署的每台机架上都能获得更多输出。
AMD在其中发挥了怎样的作用?
“前沿AI基础设施正在快速演进,客户需要既能提供卓越性能,同时又能随着工作负载的增长实现高效扩展的平台。AMD Helios将领先的计算能力、高性能网络和开放软件整合到统一的机架级平台中。这些技术的结合,为客户提供了灵活性,以加速大规模推理、前沿模型训练和下一代AI基础设施。”
-- AMD人工智能事业部高级副总裁Vamsi Boppana
何为AMD Helios机架级解决方案?AMD Helios通过提供开放式机架级架构扩展了AMD AI产品组合,旨在支持从单个机架到多机架集群的大规模推理、前沿模型训练和微调。AMD推出AMD Helios之际,正值AI正在重塑现代基础设施,其需要能够将高性能计算、机架级架构和开放软件紧密集成的平台。
•专为前沿AI而打造:AMD Helios是AMD专为前沿AI和AI工厂部署而打造机架级AI基础设施平台。它将第五代AMD Instinct GPU、第六代AMD EPYC服务器CPU、AMD Pensando网络和AMD ROCm软件整合到一个基于开放标准的统一平台中,为大规模推理、前沿模型训练和微调提供可扩展基础。
•领先的机架性能:AMD Helios采用针对大规模推理和前沿模型开发进行过优化的统一架构,可提供百亿亿次级AI性能。其单个架构可提供最高可达2.9 exaflops的峰值FP4性能、1.4 exaflops的峰值FP8性能、31TB HBM4内存和每秒1.7PB的内存带宽。
•可扩展AI:AMD Helios旨在实现从单个机架到吉瓦级AI集群的扩展,其每个机架集成了18个符合Open Rack Wide标准的四颗GPU计算托盘(共计72颗GPU),可为集群部署和扩展提供统一的构建模块。在集群规模下,AMD Pensando Vulcano 800 AI NIC也可提供支持分布式推理、前沿模型训练和超大规模快速扩展所需的高带宽和低延迟连接。
•开放式基础设施:AMD Helios将用于纵向高性能扩展的UALink over Ethernet (UALoE),与符合超以太网联盟(Ultra Ethernet Consortium)标准且用于横向扩展的以太网技术相结合,使客户能够利用开放且基于标准的技术构建AI基础设施。该平台还集成了多层防御的机架级安全功能。AMD ROCm软件可在机架和集群部署中实现高吞吐量推理和统一的分布式训练。
热门跟贴