Propagation of Action Potentials
Reinforcement Schedules
Associative Learning
Multi-input and Multi-variable systems
Randomized Experiments
Random Variables
您也可能阅读
通过共同作者、期刊和引用图与本文相关的文章。
我们介绍了SVPG (Spiking Variational Policy Gradient),这是一个由大脑功能启发的新型强化学习方法. SVPG弥合了奖励调制的峰值时间依赖可塑性 (R-STDP) 的差距,以提高性能和稳定性.
科学领域:
背景情况:
研究的目的:
主要方法:
主要成果:
结论: