Probability Distributions
Reinforcement Schedules
Uniform Distribution
State Space Representation
Sampling Continuous Time Signal
Poisson Probability Distribution
您也可能阅读
通过共同作者、期刊和引用图与本文相关的文章。
在强化学习 (RL) 中分离连续行动空间可以增加差异. 本研究介绍了一种使用Poisson分布的单模政策,以提高复杂控制任务中的稳定性和性能.
科学领域:
背景情况:
研究的目的:
主要方法:
主要成果:
结论: