Naga Sai Shreya Kunda1, Pranave Kc1, Mayank Pandey1

  • 1Department of Computer Science and Engineering, Amrita School of Computing, Amrita Vishwa Vidyapeetham, Bengaluru, India.

Scientific reports
|December 16, 2025
PubMed
概括

在深度强化学习 (DRL) 中优化奖励系统和超参数可以显著提高自主赛车的性能. 精心调整的近距离政策优化 (PPO) 代理人在多种多样的未见的轨道上有效地泛化.