用户工具

站点工具


qflow:rocky_cpu

差别

这里会显示出您选择的修订版和当前版本之间的差别。

到此差别页面的链接

后一修订版
前一修订版
qflow:rocky_cpu [2026/06/30 17:02] – 创建 - 外部编辑 127.0.0.1qflow:rocky_cpu [2026/07/13 17:23] (当前版本) – 外部编辑 127.0.0.1
行 2: 行 2:
  
 适用系统:Rocky Linux 8.10\\ 适用系统:Rocky Linux 8.10\\
-包含:NVIDIA 显卡驱动、Docker、nvidia-container-toolkit+包含:Docker
  
 ---- ----
  
-===== 系统设置 =====+===== 1. 系统设置 =====
  
 ==== 1.1 关防火墙 ==== ==== 1.1 关防火墙 ====
行 14: 行 14:
 systemctl disable firewalld systemctl disable firewalld
 </code> </code>
- 
-===== 1. 安装 NVIDIA 显卡驱动 ===== 
- 
-==== 1.1 确认系统能识别到 NVIDIA 显卡 ==== 
- 
-<code bash> 
-lspci | grep -i nvidia 
-</code> 
- 
-==== 1.2 检查驱动是否已经安装 ==== 
- 
-<code bash> 
-nvidia-smi 
-</code> 
- 
-如果能看到显卡型号、驱动版本、CUDA 版本等信息,说明驱动已经安装。 
- 
-==== 1.3 安装依赖包 ==== 
- 
-<code bash> 
-# 安装开发工具组 
-sudo dnf groupinstall "Development Tools" -y 
- 
-# 安装与当前内核匹配的开发包 
-sudo dnf install -y kernel-devel-$(uname -r) kernel-headers 
- 
-# 启用必要的软件仓库 
-sudo dnf install epel-release -y 
- 
-# 安装 DKMS,帮助内核更新后自动重建驱动 
-sudo dnf install -y dkms 
-</code> 
- 
-==== 1.4 禁用系统自带的 nouveau 驱动 ==== 
- 
-<code bash> 
-sudo grubby --args="nouveau.modeset=0 rd.driver.blacklist=nouveau" --update-kernel=ALL 
- 
-# 重启系统使配置生效 
-sudo reboot 
-</code> 
- 
-==== 1.5 使用 DNF 包管理器安装驱动 ==== 
- 
-<code bash> 
-# 启用必要的软件仓库 
-sudo dnf config-manager --set-enabled powertools 
- 
-# 添加 NVIDIA 官方仓库 
-sudo cat > /etc/yum.repos.d/cuda-rhel8.repo << 'EOF' 
-[cuda-rhel8-x86_64] 
-name=cuda-rhel8-x86_64 
-baseurl=https://developer.download.nvidia.com/compute/cuda/repos/rhel8/x86_64 
-enabled=1 
-gpgcheck=1 
-gpgkey=https://developer.download.nvidia.com/compute/cuda/repos/rhel8/x86_64/D42D0685.pub 
-EOF 
- 
-# 启用 nvidia-driver 模块的 latest-dkms 流(推荐使用 DKMS) 
-sudo dnf module enable nvidia-driver:570-dkms -y 
- 
-# 安装驱动 
-sudo dnf install -y cuda-drivers 
-</code> 
- 
-==== 1.6 重启系统 ==== 
- 
-<code bash> 
-sudo reboot 
-</code> 
- 
-==== 1.7 验证驱动安装 ==== 
- 
-<code bash> 
-nvidia-smi 
-</code> 
- 
-如果能看到显卡型号、驱动版本、CUDA 版本等信息,说明驱动已成功安装。 
- 
----- 
  
 ===== 2. 安装 Docker ===== ===== 2. 安装 Docker =====
  
-==== 2.1 安装依赖并添加 Docker 官方仓库 ====+点击链接, 从<wrap em>安装 Docker</wrap>章节开始: [[qflow:rocky_gpu#安装 Docker|跳转到安装 Docker章节]] 跟着文档安装到此章节再返回此文档
  
-<code bash> +===== 3. qflow cpu 容器版 =====
-# 安装依赖工具 +
-sudo dnf install -y dnf-utils device-mapper-persistent-data lvm2 +
- +
-# 添加 Docker 官方仓库(使用阿里云镜像加速) +
-sudo dnf config-manager --add-repo \ +
-  https://mirrors.aliyun.com/docker-ce/linux/centos/docker-ce.repo +
-</code> +
- +
-==== 2.2 安装 Docker 引擎 ==== +
- +
-<code bash> +
-sudo dnf install -y docker-ce docker-ce-cli containerd.io +
-</code> +
- +
-==== 2.启动并设置开机自启 ==== +
- +
-<code bash> +
-sudo systemctl start docker +
-sudo systemctl enable docker +
-</code> +
- +
-==== 2.4 验证安装 ==== +
- +
-<code bash> +
-sudo docker run --rm swr.cn-north-4.myhuaweicloud.com/ddn-k8s/docker.io/hello-world:latest +
-</code> +
- +
-==== 2.5 (可选)配置非 root 用户权限 ==== +
- +
-<code bash> +
-sudo usermod -aG docker $USER +
-</code> +
- +
-> 注意:需要重新登录或重启会话才能生效。 +
- +
----- +
- +
-===== 3. 安装 nvidia-container-toolkit ===== +
- +
-==== 3.1 安装 nvidia-container-toolkit ==== +
- +
-<code bash> +
-sudo dnf install -y nvidia-container-toolkit +
-</code> +
- +
-==== 3.2 配置 Docker 运行时 ==== +
- +
-<code bash> +
-sudo nvidia-ctk runtime configure --runtime=docker +
-</code> +
- +
-==== 3.3 重启 Docker 服务 ==== +
- +
-<code bash> +
-# 务必重启 Docker 服务使配置生效 +
-sudo systemctl restart docker +
-</code> +
- +
-==== 3.4 验证安装 ==== +
- +
-<code bash> +
-sudo docker run --rm --gpus all swr.cn-north-4.myhuaweicloud.com/ddn-k8s/docker.io/nvidia/cuda:12.4.0-base-ubuntu22.04 nvidia-smi +
-</code>+
  
-如果容器内能正常输出 ''nvidia-smi'' 信息,说明 nvidia-container-toolkit 安装成功。+点击链接, 从<wrap em>宿主机安装 server.py 服务</wrap>开始: [[qflow:quickstart_cpu#宿主机安装 server.py 服务|跳转到宿主机安装 server.py 服务章节]] 跟着文档安装到结尾
  
 +~~DISCUSSION:off~~
qflow/rocky_cpu.1782810179.txt.gz · 最后更改: 2026/06/30 17:02 由 127.0.0.1