ROCm PyPI 安装加速实践 在 AMD GPU 上跑深度学习时,安装带 ROCm 支持的 PyTorch 往往是第一步,也是最容易卡住的一步。一个 `torch` + `torchvision` + `torchaudio` 的 ROCm 组合动辄数 GB,默认从境外源拉取,速度可能只有几百 KB/s,中途断流、校验失败也时有发生。本文梳理几条可落地的加速思路,帮助把安装时间从“泡杯咖啡等半