Reinforcement Schedules
Decision Making: Traditional Method
Decision Making: P-value Method
Mechanistic Models: Compartment Models in Algorithms for Numerical Problem Solving
Persuasion Strategies
Statically Indeterminate Problem Solving
您也可能阅读
通过共同作者、期刊和引用图与本文相关的文章。
Daisuke Uragami1, Noriaki Sonota2, Tatsuji Takahashi2
1College of Industrial Technology, Nihon University, 1-2-1, Izumi, Narashino, Chiba, 275-8575, Japan.
社会满足使多代理强化学习代理人能够通过分享愿望水平来有效地找到最佳解决方案. 这种新的框架提高了学习效率,并自主调整了探索范围.
科学领域:
背景情况:
研究的目的:
主要方法:
主要成果:
结论: