,使.

Shuaijun Wang1, Lining Sun1, Fusheng Zha1

  • 1State Key Laboratory of Robotics and System, Harbin Institute of Technology, Harbin, China.

PubMed
概括

本研究介绍了一个深度强化学习框架,用于机器人物体推. 该方法通过将联系信息纳入奖励函数来提高成功率和对新对象的概括性.