这次我们来看一个关于 AI 转行学习路径中非常关键的一步:安装 Docker。对于任何希望进入 AI 开发、模型部署或 MLOps 领域的人来说,Docker 都是一个绕不开的基石工具。它解决了“在我机器上能跑,在你机器上就报错”的经典难题,让环境隔离、依赖管理和服务部署变得标准化。这篇文章的重点不是讲 Docker 的复杂概念,而是直接告诉你:如何在主流操作系统上,用最清晰、最稳妥的方式把 Docker 装好、跑起来。我们会覆盖 Windows、macOS 和 Linux(Ubuntu)三大平台,并重点关注安装后的基础验证、常见问题排查,以及如何为后续的 AI 项目(如运行 Stable Diffusion WebUI、部署模型 API 服务)做好准备。如果你正处在 AI 转行的学习阶段,或者需要在本地搭建一个干净、可复现的 AI 实验环境,那么正确安装和配置 Docker 是必须跨过的第一道门槛。本文将提供详细的步骤、可复制的命令,并解释每一步背后的原因,确保你能一次成功。1. 核心能力速览在深入安装步骤前,我们先快速了解 Docker 的核心价值以及本文的覆盖范围。能力项说明核心价值容器化技术,实现应用及其依赖的标准化打包、分发和运行,确保环境一致性。对 AI 的意义轻松部署复杂的 AI 框架(PyTorch, TensorFlow)、运行预构建的模型镜像、隔离不同项目的 Python 环境。硬件门槛极低。主要依赖操作系统支持,对 CPU/GPU 有虚拟化要求(Windows/macOS),Linux 原生支持。支持平台Windows 10/11 (专业版/企业版/教育版)、macOS、Linux (Ubuntu, CentOS 等)。安装后核心操作拉取镜像、运行容器、映射端口、挂载目录、查看日志。后续 AI 应用场景运行stable-diffusion-webuiDocker 版、部署ollama、搭建text-generation-webui或自定义模型 API 服务。2. 为什么 AI 开发需要 Docker?在 AI 项目,尤其是深度学习项目中,依赖环境复杂且易冲突。你可能需要特定版本的 CUDA、特定分支的 PyTorch、以及一系列难以兼容的 Python 包。Docker 通过容器技术,将应用代码、运行时环境、系统工具和库打包成一个独立的“镜像”。这个镜像可以在任何安装了 Docker 的机器上以“容器”的形式运行,且行为完全一致。具体好处包括:环境隔离:项目 A 用 Python 3.8 + PyTorch 1.12,项目 B 用 Python 3.10 + PyTorch 2.0,互不干扰。一键部署:无需再写冗长的requirements.txt和安装文档,直接docker run即可启动服务。资源可控:可以限制容器使用的 CPU、内存,甚至 GPU(通过 NVIDIA Container Toolkit)。易于分享和协作:你可以将构建好的镜像推送到 Docker Hub 或私有仓库,团队成员直接拉取即可复现你的环境。对于“AI 转行第 34 天”这个阶段,掌握 Docker 意味着你开始从“跑通单个 Notebook”向“构建可复现、可部署的工程化项目”迈进。3. 环境准备与前置检查安装 Docker 前,请根据你的操作系统完成以下前置检查,这能避免大部分安装失败的问题。3.1 Windows 系统准备版本要求:必须为Windows 10 版本 2004 及更高版本(内部版本 19041 及以上)或 Windows 11。家庭版需要安装 WSL 2 后端。启用虚拟化:在 BIOS/UEFI 设置中启用 CPU 的虚拟化技术(如 Intel VT-x 或 AMD-V)。通常在开机时按 F2、F10、Del 等键进入 BIOS 设置。启用 WSL 2(推荐):WSL 2 提供了更好的 Docker 体验和性能。以管理员身份打开 PowerShell 或命令提示符。运行以下命令启用“适用于 Linux 的 Windows 子系统”和“虚拟机平台”功能:wsl --install重启计算机。硬件要求:64 位处理器,4GB 及以上 RAM。3.2 m