科技媒体Tom's Hardware昨日(9月14日)发布博文,报道称开源项目CUDA-for-AMD-Windows正冲击英伟达的CUDA护城河,已在AMD Radeon RX 9060 XT演示运行部分CUDA库。
CUDA是英伟达的通用GPU加速计算平台,提供编译器、运行时、调试器、性能分析工具,以及可直接调用的GPU加速库。
由于CUDA是深度绑定英伟达GPU的开发平台、加速库、工具链和开发者生态,因此在业界被认为是英伟达的“护城河”。
开发者Speedstu发布的CUDA-for-AMD-Windows开源项目,是一套可复现的PowerShell自动化配置,结合ZLUDA的翻译层与AMD原生HIP/ROCm,在Windows上为RTX-等CUDA依赖的软件提供“翻译入口”。
该配置脚本会识别GPU架构,并下载固定的ZLUDA v6-preview.69。随后,工具尝试将CUDA调用映射到Windows已安装的ROCm数学库。
在兼容范围上,开发者已拦截CUDA驱动程序API,cuBLAS、cuSPARSE和cuFFT也可映射至AMD对应组件。因此,部分只面向NVIDIA CUDA的应用,可在Windows的AMD显卡上尝试运行。
在概念验证项目中,该开发者在未修改的CUDA库下,使用AMD的Radeon RX 9060 XT进行端到端的220万参数PPO强化学习网络训练。
同时,项目文档给出了Radeon RX 9060 XT的A/B测试。官方上游路径使用官方ZLUDA与AMD HIP SDK 6.4。
其整体中位吞吐为13278.46 SPS,平均吞吐为13172.49 SPS。回收自定义覆盖路径的整体中位吞吐为12875.80 SPS,平均吞吐为12649.83 SPS。
SPS是每秒步数(steps per second)。表中“恢复的自定义路径”(加入旧版定制ZLUDA组件的配置)相较“公开上游路径”(标准、可公开获得的配置),吞吐量均较低,而推理和PPO学习耗时更长。
本文源自:IT之家
热门跟贴