diff --git a/四足机器狗训练到实机部署全流程指南.md b/四足机器狗训练到实机部署全流程指南.md index 4447e80..695cef8 100644 --- a/四足机器狗训练到实机部署全流程指南.md +++ b/四足机器狗训练到实机部署全流程指南.md @@ -384,22 +384,27 @@ python -c "import onnxruntime as ort; s=ort.InferenceSession('policy_robotlab_26 预期输入为 450 个 `float32`,输出为 12 个动作。输入输出不匹配时不要继续 sim2sim 或量化。 -### 8.4 训练仓库自带的 MuJoCo 快速检查 +### 8.4 独立 MuJoCo 快速检查 -训练仓库还提供了基于 TorchScript 的 Go1 MuJoCo 入口。它接收当前 45 维单帧观测,并在模型内部维护 10 帧历史,适合在进入完整 RoboGauge 评估前做一次快速检查: +如果你要做的是“和部署链路一致”的快速检查,直接使用部署仓库里的 ONNX 入口。它读取当前 45 维单帧观测,并在脚本内部维护 10 帧历史,适合在进入完整 RoboGauge 评估前核对观测、动作缩放和地形 XML: ```bash -mkdir -p deploy/pre_train/go1 -cp /exported/policy.pt deploy/pre_train/go1/policy.pt +cd /path/to/go1_pro_deploy +MUJOCO_GL=glfw mjpython deploy_45dim_rl_gym/deploy_go1_onnx_mujoco_lab.py \ + --onnx deploy_45dim_rl_gym/policy_robotlab_26000.onnx ``` -确认 `deploy/deploy_mujoco/configs/go1.yaml` 中的 `policy_path` 和 `xml_path` 指向正确模型与场景,再运行: +楼梯测试同样直接切 terrain: ```bash -MUJOCO_GL=glfw python deploy/deploy_mujoco/deploy_go1.py +MUJOCO_GL=glfw mjpython deploy_45dim_rl_gym/deploy_go1_onnx_mujoco_lab.py \ + --onnx deploy_45dim_rl_gym/policy_robotlab_26000.onnx \ + --terrain deploy_45dim_rl_gym/terrains/stairs/stairs_3.xml \ + --spawn-x -0.6 \ + --spawn-z 0.34 ``` -该入口默认检测游戏手柄,`LX/LY` 控制前后和侧向速度,`RX` 控制转向;未检测到手柄时使用 YAML 中的固定指令。它与后文带键盘、ONNX 和更多日志检查的独立部署脚本用途不同。 +脚本默认 `--clip-actions 100.0`、`--max-target-step 0.0`。如果你要做更保守的起步测试,可以再按日志逐步收紧这些参数;不要把旧版本的示例值当成固定默认。 ## 9. RoboGauge 自动评估 @@ -506,22 +511,18 @@ task_name="go1_lab" cd /path/to/go1_pro_deploy conda activate -mjpython deploy_45dim_rl_gym/deploy_go1_onnx_mujoco_lab.py \ - --onnx deploy_45dim_rl_gym/policy_robotlab_26000.onnx \ - --clip-actions 4.0 \ - --max-target-step 0.15 +MUJOCO_GL=glfw mjpython deploy_45dim_rl_gym/deploy_go1_onnx_mujoco_lab.py \ + --onnx deploy_45dim_rl_gym/policy_robotlab_26000.onnx ``` 楼梯测试: ```bash -mjpython deploy_45dim_rl_gym/deploy_go1_onnx_mujoco_lab.py \ +MUJOCO_GL=glfw mjpython deploy_45dim_rl_gym/deploy_go1_onnx_mujoco_lab.py \ --onnx deploy_45dim_rl_gym/policy_robotlab_26000.onnx \ --terrain deploy_45dim_rl_gym/terrains/stairs/stairs_3.xml \ --spawn-x -0.6 \ - --spawn-z 0.34 \ - --clip-actions 4.0 \ - --max-target-step 0.15 + --spawn-z 0.34 ``` 键盘映射: