François Cinotti1,2, Etienne Coutureau3, Mehdi Khamassi1

  • 1Institut des Systèmes Intelligents et de Robotique, Sorbonne Université, CNRS, Paris, France.

概括

在做决策任务的预训练期间,老鼠逐渐稳定了他们的学习策略. 一个元学习模型解释了他们如何根据平均奖励率调整学习速度或逆温度.