学习演奏钢琴与生物制约的扩散政策为人形手学习

Yiming Yang1,2, Zechang Wang1,2, Dengpeng Xing1,2

  • 1Institute of Automation, Chinese Academy of Science, Beijing, China.

概括

这项研究引入了一种新的强化学习 (RL) 方法,即Bio-CDP,用于机器人手控制. 生物-CDP通过将类似人类的约束纳入深度学习政策来提高机器人的灵巧性.