Timing and Consequences on Behavior
Reinforcement Schedules
Nonlinear Pharmacokinetics: Causes of Nonlinearity
Reinforcement
Regression Toward the Mean
Avoidance Learning and Learned Helplessness
您也可能阅读
通过共同作者、期刊和引用图与本文相关的文章。
Boluwatife Ikwunne1, Jolie Parham1, Erdem Pulcu1,2,3
1Psychopharmacology and Emotion Research Lab, Department of Psychiatry, University of Oxford, Oxford, United Kingdom.
这项研究揭示了强化学习模型中预测错误和学习率之间的新型非线性关系. 一个指数对数函数解释了预测错误如何即时更新学习率,影响代理适应.
科学领域:
背景情况:
研究的目的:
主要方法:
主要成果:
结论: