倒立摆 RL 入门¶
用完整 MDP 建模、手写 PPO 与 Genesis 物理引擎,学习一阶倒立摆(Cart-Pole)平衡策略。
你会学到¶
- MDP 五元组与奖励设计
- PPO / GAE 的稳定训练直觉
- Genesis URDF 仿真与并行环境
- 从安装到看训练曲线的完整流程
教学站目录¶
| 页面 | 内容 |
|---|---|
| 首页 | 任务目标与结构速览 |
| MDP 建模 | 状态 / 动作 / 终止 / 奖励 |
| PPO 算法 | clip、价值、熵 |
| Genesis 仿真 | URDF 与环境要点 |
| 训练流程 | 安装与命令 |
| 实验结果 | 指标解读 |
源码位置¶
本地工作区:/home/yoy/WorkSpace/RL_Demo(或你的 RL_Demo 克隆路径)
cd /path/to/RL_Demo
source .venv/bin/activate
python scripts/train.py --backend analytical --iterations 200
元信息¶
| 字段 | 值 |
|---|---|
| slug | rl-cartpole |
| 领域 | 强化学习 |
| 状态 | active |
| 标签 | RL, PPO, Genesis, Cart-Pole |