Multi-input and Multi-variable systems
Reinforcement Schedules
Associative Learning
Generalization, Discrimination, and Extinction
Randomized Experiments
Unsoundness of Aggregate due to Volume Change
您也可能阅读
通过共同作者、期刊和引用图与本文相关的文章。
本研究介绍了一种多虚拟代理逆增强学习 (MVIRL) 方法,用于强大的AI控制. MVIRL在不确定的环境中增强了政策稳定性和弹性,优于传统方法.
科学领域:
背景情况:
研究的目的:
主要方法:
主要成果:
结论: