Multi-input and Multi-variable systems
Reinforcement Schedules
Reinforcement
Observational Learning
Mechanistic Models: Compartment Models in Algorithms for Numerical Problem Solving
Collisions in Multiple Dimensions: Problem Solving
您也可能阅读
通过共同作者、期刊和引用图与本文相关的文章。
Richardson Menezes1,2, Thiago Henrique Freire de Oliveira3, Luiz Paulo de Souza Medeiros1
1Postgraduate Program in Electrical and Computer Engineering, Federal University of Rio Grande do Norte, Natal, Brazil.
深度Q-管理,一个新的多目标强化学习 (MORL) 算法,发现所有的帕雷托前线政策. 它使用深度学习来增强在决定性环境中的多目标优化.
科学领域:
背景情况:
研究的目的:
主要方法:
主要成果:
结论: