Unix系统(如Linux、macOS)是机器学习开发的主流平台,其稳定性和可定制性深受研究者与工程师青睐。环境搭建需兼顾系统兼容性、依赖隔离与可复现性。
基础工具链应优先安装:GNU编译器套件(gcc)、CMake、pkg-config及Python(推荐3.9–3.12)。macOS用户通过Xcode Command Line Tools获取核心编译支持;Linux发行版则使用原生包管理器,如Ubuntu/Debian执行sudo apt install build-essential python3-dev,CentOS/RHEL用sudo dnf groupinstall \”Development Tools\” python3-devel。
Python环境建议采用pyenv统一管理多版本解释器,避免系统Python被意外污染。配合pipx安装独立沙盒化的命令行工具(如cookiecutter、jupyter),确保全局命令不干扰项目依赖。
项目级依赖必须隔离。推荐使用venv(Python内置)创建轻量虚拟环境,运行python -m venv .venv后激活并升级pip。不推荐全局pip install,所有包均应在激活环境下安装。关键科学计算包(numpy、scipy、matplotlib)优先通过系统包管理器安装底层优化库(如OpenBLAS),再用pip装Python绑定层,可显著提升数值运算性能。
CUDA生态需特别注意:NVIDIA驱动必须与CUDA Toolkit版本严格匹配。使用nvidia-smi确认驱动版本后,从NVIDIA官网下载对应runfile或deb/rpm包安装,避免通过第三方仓库引入不兼容组件。PyTorch/TensorFlow等框架建议直接选用官方预编译whl包,而非源码编译。
环境配置需追求可复现。requirements.txt仅记录顶层依赖,建议配合pip-tools生成锁定文件(pip-compile requirements.in > requirements.txt);更优方案是采用conda+environment.yml(尤其含C/C++扩展时),或结合Docker构建标准化镜像。所有配置变更都应通过版本控制留存。

AI渲染的图片,仅供参考
•定期清理无用包(pip-autoremove)、校验二进制依赖(ldd on Linux, otool -L on macOS)和更新系统安全补丁,构成可持续维护的机器学习基础。