AMD在vLLM上游门禁测试组上,达到了90%以上的对等水平。这个数字背后,是AMD维护者数月的持续投入,其中被点名的核心人物是Andreas。
这不是一次普通的性能跑分。vLLM的门禁测试组,是代码合入前的硬性关卡。能在这里拿到90%以上的对等,意味着AMD GPU在主流推理框架的上游流程里,已经不再是"能跑就行"的状态。
打开网易新闻 查看精彩图片
谁在推这件事
除了AMD的维护者Andreas,vLLM的CI负责人Kevin也参与其中。SemiAnalysis在这件事里扮演了另一个角色——为vLLM补上了足够的AMD GPU算力。
这个动作的直接背景,是上游维护者长达数月的不满:vLLM手上的AMD GPU不够用。与此同时,AMD的CI在整个集群层面还存在稳定性问题。算力缺口和稳定性问题叠在一起,让AMD在vLLM上游的推进一直卡着。
为什么90%这个数字值得看
上游门禁测试组的对等率,直接决定了一件事:AMD的代码改动能不能顺利进入vLLM主线。低于这条线,维护者就有理由拦下提交;达到这条线,AMD GPU在vLLM生态里的存在感才真正立得住。
从"GPU不够用"到"90%以上对等",中间隔的是几个月。AMD维护者、vLLM CI负责人、以及提供算力的SemiAnalysis,三方各自补上了一块短板。
对使用vLLM做推理部署的团队来说,这个变化意味着AMD GPU在上游框架里的可用性上了一个台阶。门禁测试组过了,后续的代码合入和版本跟进才有稳定的基础。
热门跟贴