Observational Learning
Avoidance Learning and Learned Helplessness
Reinforcement Schedules
Reinforcement
Associative Learning
Predator-Prey Interactions
您也可能阅读
通过共同作者、期刊和引用图与本文相关的文章。
本研究介绍了用于多道学习环境的回报控制策略. 这些策略使代理商能够绑定对手的回报,并引导学习到经过实验确认的所需平衡.
科学领域:
背景情况:
研究的目的:
主要方法:
主要成果:
结论: