Anya Stetsenko1, Tibor Koos1

  • 1Center for Molecular and Behavioral Neuroscience, Rutgers University, Newark, NJ 07102.

概括

研究人员发现,腹部体区域 (VTA) GABAergic神经元实施时间差异学习 (TDL) 算法. 这种电路解释了在强化学习 (RL) 中的奖励预测错误和时间折扣.