OrcaPlayground 环境搭建与踩坑实录:从零跑通四足机器人 RL 训练记录在 Windows 环境下配置 OrcaPlayground 足式机器人强化学习训练环境的完整过程,包含驱动兼容性、conda 环境搭建、目录结构分析以及 OrcaLab/OrcaStudio 的区别。📖 背景OrcaPlayground 是一个基于 OrcaGym(MuJoCo 物理引擎封装)的足式机器人强化学习训练框架,支持 SB3 PPO(单机)和 RLlib APPO(分布式)两套训练链路。本文以 Windows + SB3 PPO 链路为例,记录从零搭建到跑通训练的完整过程。1. 硬件与驱动检查第一步确认 NVIDIA 驱动版本,因为它决定了能装哪个 CUDA 版本的 PyTorch。踩坑:Windows 没有 head 命令在 Windows PowerShell 里直接敲nvidia-smi | head -3会报ObjectNotFound,因为head是 Linux 命令。换成:nvidia-smi|Select-Object-First 3或者直接看第一屏:nvidia-smi输出示例:NVIDIA-SMI 580.92 Driver Version: 580.92 CUDA Version: 13.0Driver Version 580.92,CUDA 13.0,属于非常新的驱动。2. PyTorch 安装与驱动兼容性examples/legged_gym/requirements.txt里有一张兼容性对照表:NVIDIA 驱动版本支持的最高 CUDAPyTorch 安装命令≥ 57012.8+pip install torch=2.7.0≥ 56012.6+