DDPG

Yanbiao Li1,2, Zhao Chen1,2,3, Chentao Wu1,2

  • 1College of Mechanical Engineering, Zhejiang University of Technology, Hangzhou 310023, China.

PubMed
概括

本研究介绍了四足机器人运动控制的等级强化学习框架. 这种新的方法与标准的深度决定性政策梯度方法相比,提高了控制性能.