跳至内容
龙讯旷腾 pwmat Wiki
用户工具
注册
登录
站点工具
搜索
工具
显示页面
过去修订
全部折叠/展开
反向链接
最近更改
媒体管理器
网站地图
注册
登录
>
最近更改
媒体管理器
网站地图
您的足迹:
qflow:rocky_gpu
本页面只读。您可以查看源文件,但不能更改它。如果您觉得这是系统错误,请联系管理员。
====== qflow gpu 容器版 rocky8.10 安装指南 ====== 适用系统:Rocky Linux 8.10\\ 包含:NVIDIA 显卡驱动、Docker、nvidia-container-toolkit ---- ===== 1. 系统设置 ===== ==== 1.1 关防火墙 ==== <code bash> sudo systemctl stop firewalld sudo systemctl disable firewalld </code> ===== 2. 安装 NVIDIA 显卡驱动 ===== ==== 2.1 确认系统能识别到 NVIDIA 显卡 ==== <code bash> # 安装硬件检查工具 sudo dnf install pciutils -y # 识别显卡信息 lspci | grep -i nvidia </code> ==== 2.2 检查驱动是否已经安装 ==== <code bash> nvidia-smi </code> 如果能看到显卡型号、驱动版本、CUDA 版本(CUDA Version:12.1 以上)等信息,说明驱动已正常安装,直接进行第 3 步;若未识别到驱动版本,请继续完成后续安装操作。 ==== 2.3 安装依赖包 ==== <code bash> # 安装开发工具组 sudo dnf groupinstall "Development Tools" -y # 安装与当前内核匹配的开发包 sudo dnf install -y kernel-devel-$(uname -r) kernel-headers # 启用必要的软件仓库 sudo dnf install epel-release -y # 安装 DKMS,帮助内核更新后自动重建驱动 sudo dnf install -y dkms </code> ==== 2.4 禁用系统自带的 nouveau 驱动 ==== <code bash> sudo grubby --args="nouveau.modeset=0 rd.driver.blacklist=nouveau" --update-kernel=ALL # 重启系统使配置生效 sudo reboot </code> ==== 2.5 使用 DNF 包管理器安装驱动 ==== <code bash> # 启用必要的软件仓库 sudo dnf config-manager --set-enabled powertools # 添加 NVIDIA 官方仓库 sudo tee /etc/yum.repos.d/cuda-rhel8.repo << 'EOF' [cuda-rhel8-x86_64] name=cuda-rhel8-x86_64 baseurl=https://developer.download.nvidia.com/compute/cuda/repos/rhel8/x86_64 enabled=1 gpgcheck=1 gpgkey=https://developer.download.nvidia.com/compute/cuda/repos/rhel8/x86_64/D42D0685.pub EOF # 启用 nvidia-driver 模块的 latest-dkms 流(推荐使用 DKMS) sudo dnf module enable nvidia-driver:570-dkms -y # 安装驱动 sudo dnf install -y cuda-drivers </code> ==== 2.6 重启系统 ==== <code bash> sudo reboot </code> ==== 2.7 验证驱动安装 ==== <code bash> nvidia-smi </code> 如果能看到显卡型号、驱动版本、CUDA 版本等信息,说明驱动已成功安装。 ---- ===== 3. 安装 Docker ===== ==== 3.1 安装依赖并添加 Docker 官方仓库 ==== <code bash> # 安装依赖工具 sudo dnf install -y dnf-utils device-mapper-persistent-data lvm2 # 添加 Docker 官方仓库(使用阿里云镜像加速) sudo dnf config-manager --add-repo \ https://mirrors.aliyun.com/docker-ce/linux/centos/docker-ce.repo </code> ==== 3.2 安装 Docker 引擎 ==== <code bash> sudo dnf install -y docker-ce docker-ce-cli containerd.io </code> ==== 3.3 启动并设置开机自启 ==== <code bash> sudo systemctl start docker sudo systemctl enable docker </code> ==== 3.4 验证安装 ==== <code bash> sudo docker run --rm swr.cn-north-4.myhuaweicloud.com/ddn-k8s/docker.io/hello-world:latest </code> ==== 3.5 (可选)配置非 root 用户权限 ==== <code bash> sudo usermod -aG docker $USER </code> > 注意:需要重新登录或重启会话才能生效。 ---- ===== 4. 安装 nvidia-container-toolkit ===== ==== 4.1 安装 nvidia-container-toolkit ==== <code bash> sudo dnf install -y nvidia-container-toolkit </code> ==== 4.2 配置 Docker 运行时 ==== <code bash> sudo nvidia-ctk runtime configure --runtime=docker </code> ==== 4.3 重启 Docker 服务 ==== <code bash> # 务必重启 Docker 服务使配置生效 sudo systemctl restart docker </code> ==== 4.4 验证安装 ==== <code bash> sudo docker run --rm --gpus all swr.cn-north-4.myhuaweicloud.com/ddn-k8s/docker.io/nvidia/cuda:12.4.0-base-ubuntu22.04 nvidia-smi </code> 如果容器内能正常输出 ''nvidia-smi'' 信息,说明 nvidia-container-toolkit 安装成功。 ===== 5. qflow gpu 容器版 ===== 点击链接, 从 ''宿主机安装 server.py 服务'' 开始: [[qflow:quickstart_gpu#宿主机安装 server.py 服务|跳转到宿主机安装 server.py 服务章节]] 跟着文档安装到结尾 ~~DISCUSSION:off~~
qflow/rocky_gpu.txt
· 最后更改: 2026/07/13 16:57 由
127.0.0.1
页面工具
显示页面
过去修订
反向链接
全部折叠/展开
回到顶部