Skip to content

Ubuntu 24.04 / Windows 11 环境准备:ROCm 10.0.0 + PyTorch + vLLM(以 gfx1151 为例)

ROCm 10.0.0 部署 Qwen3.5 推理框架环境准备指南。

本节以 Ryzen AI Max / Ryzen AI Max+(gfx1151) 为参考。Qwen3.5 架构较新,部署时还要确认 vLLM / transformers 是否识别 qwen3_5 模型类型。完整基线见 00-Environment,版本差异见 ROCm 10.0.0 版本说明

官方参考:


一、清理旧环境

bash
sudo apt remove 'rocm*' 'amdrocm*' 'amdgpu-dkms*' -y
sudo apt autoremove -y

Windows:卸载旧 HIP SDK,安装 Adrenalin 26.8.1


二、Ubuntu 24.04 + gfx1151

bash
sudo apt update
sudo apt install -y linux-oem-24.04c libatomic1 libquadmath0 build-essential git curl wget jq pciutils
sudo usermod -a -G render,video $LOGNAME
sudo reboot
bash
curl -LsSf https://astral.sh/uv/install.sh | sh
uv python install 3.12
uv venv --python 3.12
source .venv/bin/activate

uv pip install --index-url https://stable.repo.amd.com/rocm/whl-next/ \
  "torch[device-gfx1151]==2.13.0+rocm10.0.0" \
  "torchvision[device-gfx1151]==0.28.0+rocm10.0.0" \
  "torchaudio==2.11.0.2+rocm10.0.0"
bash
python -c "import torch; print(torch.__version__, torch.cuda.is_available())"

三、Windows 11 + pip

powershell
irm https://astral.sh/uv/install.ps1 | iex
uv python install 3.12
uv venv --python 3.12
.venv\Scripts\activate

uv pip install --index-url https://stable.repo.amd.com/rocm/whl-next/ `
  "torch[device-gfx1151]==2.13.0+rocm10.0.0" `
  "torchvision[device-gfx1151]==0.28.0+rocm10.0.0" `
  "torchaudio==2.11.0.2+rocm10.0.0"

四、vLLM Docker(0.27.0)

bash
docker pull rocm/vllm:rocm10.0.0_ubuntu24.04_py3.14_pytorch_2.12.0_vllm_0.27.0

docker run -it --rm \
  --device /dev/kfd --device /dev/dri \
  --network=host --ipc=host --group-add=video \
  --cap-add=SYS_PTRACE --security-opt seccomp=unconfined \
  -v ~/models:/app/models -e HF_HOME="/app/models" \
  rocm/vllm:rocm10.0.0_ubuntu24.04_py3.14_pytorch_2.12.0_vllm_0.27.0 \
  bash

五、Qwen3.5 部署前检查

  1. vLLM 是否为 0.27.0 官方镜像或对应 wheel;
  2. transformers 是否识别 qwen3_5
  3. --max-model-len 是否过大导致显存不足;
  4. API 请求是否按需要设置 enable_thinking

六、后续部署教程