冲击英伟达护城河:开源项目让AMD RX 9060 XT跑通部分CUDA库
IT之家 9 月 15 日消息,科技媒体 Tom's Hardware 昨日(9 月 14 日)发布博文,报道称开源项目 CUDA-for-AMD-Windows 正冲击英伟达的 CUDA 护城河,已在 AMD Radeon RX 9060 XT 演示运行部分 CUDA 库。
IT之家注:CUDA 是英伟达的通用 GPU 加速计算平台,提供编译器、运行时、调试器、性能分析工具,以及可直接调用的 GPU 加速库。
由于 CUDA 是深度绑定英伟达 GPU 的开发平台、加速库、工具链和开发者生态,因此在业界被认为是英伟达的“护城河”。
开发者 Speedstu 发布的 CUDA-for-AMD-Windows 开源项目,是一套可复现的 PowerShell 自动化配置,结合 ZLUDA 的翻译层与 AMD 原生 HIP / ROCm,在 Windows 上为 RTX-等 CUDA 依赖的软件提供“翻译入口”。
该配置脚本会识别 GPU 架构,并下载固定的 ZLUDA v6-preview.69。随后,工具尝试将 CUDA 调用映射到 Windows 已安装的 ROCm 数学库。

在兼容范围上,开发者已拦截 CUDA 驱动程序 API,cuBLAS、cuSPARSE 和 cuFFT 也可映射至 AMD 对应组件。因此,部分只面向 NVIDIA CUDA 的应用,可在 Windows 的 AMD 显卡上尝试运行。
在概念验证项目中,该开发者在未修改的 CUDA 库下,使用 AMD 的 Radeon RX 9060 XT 进行端到端的 220 万参数 PPO 强化学习网络训练。
同时,项目文档给出了 Radeon RX 9060 XT 的 A/B 测试。官方上游路径使用官方 ZLUDA 与 AMD HIP SDK 6.4。
其整体中位吞吐为 13278.46 SPS,平均吞吐为 13172.49 SPS。回收自定义覆盖路径的整体中位吞吐为 12875.80 SPS,平均吞吐为 12649.83 SPS。
指标 公开上游路径 恢复的自定义路径 自定义路径变化 总体 SPS,中位数 13,278.46 12,875.80 -3.03% 总体 SPS,平均值 13,172.49 12,649.83 -3.97% 数据采集 SPS,中位数 63,306.00 59,360.67 -6.23% 数据消耗 SPS,中位数 16,806.36 16,445.66 -2.15% 推理时间,中位数 0.5863 秒 0.6293 秒 +7.33% PPO 学习时间,中位数 3.2076 秒 3.2958 秒 +2.75%
SPS 是每秒步数(steps per second)。表中“恢复的自定义路径”(加入旧版定制 ZLUDA 组件的配置)相较“公开上游路径”(标准、可公开获得的配置),吞吐量均较低,而推理和 PPO 学习耗时更长。
参考
“特别声明:以上作品内容(包括在内的视频、图片或音频)为凤凰网旗下自媒体平台“大风号”用户上传并发布,本平台仅提供信息存储空间服务。
Notice: The content above (including the videos, pictures and audios if any) is uploaded and posted by the user of Dafeng Hao, which is a social media platform and merely provides information storage space services.”




