Reinforcement Schedules
Timing and Consequences on Behavior
Law of Effect
Generalization, Discrimination, and Extinction
BIBO stability of continuous and discrete -time systems
Decision Making
您也可能阅读
通过共同作者、期刊和引用图与本文相关的文章。
本研究介绍了半无限受约束的马尔科夫决策过程 (SICMDP) 和两个新的算法,SI-CMBRL和SI-CPO,用于使用强化学习解决复杂的控制任务.
科学领域:
背景情况:
研究的目的:
主要方法:
主要成果:
结论: