Woodward–Hoffmann Selection Rules and Microscopic Reversibility
Decision Making: P-value Method
Multi-input and Multi-variable systems
Observational Learning
Reinforcement
Decision Making
您也可能阅读
通过共同作者、期刊和引用图与本文相关的文章。
本研究介绍了可解释的深度强化学习 (DRL) 的微分感应逻辑编程 (DILP). 政策优化镜像下降 (MDPO) 有效地解决了基于DILP的政策的限制,提高了可解释性.
科学领域:
背景情况:
研究的目的:
主要方法:
主要成果:
结论: