Masking and Demasking Agents
Multi-input and Multi-variable systems
Associative Learning
Reinforcement
Reinforcement Schedules
Observational Learning
您也可能阅读
通过共同作者、期刊和引用图与本文相关的文章。
多任务多代理强化学习 (MARL) 的双重政策融合提高了在动态环境中的适应能力. 这种方法有效地减轻了负面转移,通过整合强有力的学习的共同和特定任务政策.
科学领域:
背景情况:
研究的目的:
主要方法:
主要成果:
结论: