Linux深度学习环境搭建全流程指南

选择稳定且长期支持的Linux发行版,推荐Ubuntu 22.04 LTS或CentOS Stream 8,确保内核版本≥5.4,以兼容主流GPU驱动与CUDA工具链。

更新系统并安装基础依赖:执行sudo apt update && sudo apt upgrade -y(Ubuntu)或sudo dnf update -y(CentOS),随后安装build-essential、cmake、git、wget、curl、python3-pip等开发工具包。

AI渲染效果图,仅供参考

安装NVIDIA驱动:先禁用nouveau驱动,在/etc/modprobe.d/blacklist.conf中添加blacklist nouveau和options nouveau modeset=0;重启后运行sudo apt install nvidia-driver-535(Ubuntu)或通过官网.run文件手动安装,验证用nvidia-smi命令。

配置CUDA与cuDNN:从NVIDIA官网下载匹配驱动版本的CUDA Toolkit(如12.2)及对应cuDNN(v8.9.x),按官方文档依次安装.run文件或deb包;将/usr/local/cuda/bin加入PATH,/usr/local/cuda/lib64加入LD_LIBRARY_PATH,并写入~/.bashrc生效。

创建独立Python环境:使用conda(推荐Miniconda)创建专属环境,如conda create -n dl-env python=3.10,激活后升级pip,再安装PyTorch、TensorFlow等框架——务必选用GPU版本,例如pip install torch torchvision torchaudio –index-url https://download.pytorch.org/whl/cu121。

验证GPU可用性:在Python中运行import torch; print(torch.cuda.is_available()) 和 print(torch.cuda.device_count()),确认输出True及设备数量;同时测试TensorFlow:import tensorflow as tf; print(tf.config.list_physical_devices(‘GPU’))。

安装常用辅助工具:Jupyter Lab(pip install jupyterlab)、VS Code(.deb包或snap安装),并配置Remote-SSH或WSL2远程开发;启用GPU加速的docker:安装Docker CE,添加用户到docker组,再安装nvidia-container-toolkit以支持容器内GPU调用。

安全与维护建议:定期检查驱动与CUDA版本兼容性公告;避免混用不同源安装的CUDA组件;保留基础镜像快照或使用Dockerfile固化环境,便于迁移与复现;禁用不必要的系统服务,减少资源争用。

dawei

【声明】:东营站长网内容转载自互联网,其相关言论仅代表作者个人观点绝非权威,不代表本站立场。如您发现内容存在版权问题,请提交相关链接至邮箱:bqsm@foxmail.com,我们将及时予以处理。

发表回复