一个具有昂贵重置的渐进式比率任务揭示了适应性努力延迟权衡
bioRxiv : the preprint server for biology
|June 12, 2025
概括
渐进式比例与重置 (PRR) 任务通过允许老鼠重置工作需求来增强动机测量. 老鼠适应性地使用了重置杆,接近最佳的食策略,但对更长的发作有偏见.
科学领域:
- 行为神经科学 行为神经科学
- 动物行为 动物行为
- 强化学习是一种强化学习.
背景情况:
- 进步比率 (PR) 时间表通过增加对奖励的工作来衡量动机.
- 公共关系任务的断点是激励价值的有限度.
- 现有的模型缺乏一个动态优化组件来增强器值.
研究的目的:
- 引入一个修改后的渐进式比率任务 (PRR),该任务将框架强化估值作为一个优化问题.
- 在PRR任务中分析老鼠行为,专注于适应性重置决策.
- 将老鼠策略与最佳食理论进行比较,并识别行为偏见.
主要方法:
- 鼠标执行了一个PR任务,添加了一个重置杆,以降低成本 (延迟) 的工作要求.
- 收集了杆按压和重置决策的行为数据.
- 基于奖励率和重置成本,我们得出了对比赛长度的最佳策略.
主要成果:
- 鼠标通过适应性地使用重置杆,对重置延迟成本做出敏感的决定.
- 鼠的行为接近了从中得出的最佳比赛长度策略.
- 观察到对过度采集 (比最佳时间更长的时间) 的系统偏见.
结论:
- 渐进式比例与重置 (PRR) 任务提供了比标准PR时间表更丰富的行为读数.
- 鼠表现出适应性决策,以响应成本效益结构,与最佳食原则保持一致.
- 在不断变化的环境需求下,PRR任务为研究协会学习和决策提供了一个新的平台.


