Reinforcement learning using neural networks in estimating an optimal dynamic treatment regime in patients with

Weijie Liang1, Jinzhu Jia2

  • 1Department of Biostatistics, School of Public Health, Peking University, No. 38 Xueyuan Road, Beijing, 100191, China.

Abstract