跳转至

倒立摆 RL 入门

用完整 MDP 建模、手写 PPOGenesis 物理引擎,学习一阶倒立摆(Cart-Pole)平衡策略。

打开完整教学站 →

你会学到

  • MDP 五元组与奖励设计
  • PPO / GAE 的稳定训练直觉
  • Genesis URDF 仿真与并行环境
  • 从安装到看训练曲线的完整流程

教学站目录

页面 内容
首页 任务目标与结构速览
MDP 建模 状态 / 动作 / 终止 / 奖励
PPO 算法 clip、价值、熵
Genesis 仿真 URDF 与环境要点
训练流程 安装与命令
实验结果 指标解读

源码位置

本地工作区:/home/yoy/WorkSpace/RL_Demo(或你的 RL_Demo 克隆路径)

cd /path/to/RL_Demo
source .venv/bin/activate
python scripts/train.py --backend analytical --iterations 200

元信息

字段
slug rl-cartpole
领域 强化学习
状态 active
标签 RL, PPO, Genesis, Cart-Pole