Observational Learning
Associative Learning
Reinforcement Schedules
Generalization, Discrimination, and Extinction
Reinforcement
Nonconscious Mimicry
您也可能阅读
通过共同作者、期刊和引用图与本文相关的文章。
1Department of Automation, Xiamen University, Xiamen, 361005, China.
我们介绍了基于动态的行为相似性 (RDS) 的表示学习,以改善深度强化学习. 通过消除奖励依赖,RDS增强了表示学习,在复杂的操纵任务中实现了显著的性能增长.
科学领域:
背景情况:
研究的目的:
主要方法:
主要成果:
结论: