Showing results (1-10 of 5) with videos related to
Sort By:
Pageof 1
Neural Computation|February 24, 2023
Multistream-Based Marked Point Process With Decomposed Cumulative Hazard FunctionsHirotaka Hachiya, Sujun HongNeural Computation|August 20, 2011
Reward-weighted regression with sample reuse for direct policy search in reinforcement learningHirotaka Hachiya, Jan Peters, Masashi SugiyamaNeural Computation|April 4, 2013
Relative density-ratio estimation for robust distribution comparisonMakoto Yamada, Taiji Suzuki, Takafumi Kanamori, et al.Neural Computation|October 10, 2013
Information-maximization clustering based on squared-loss mutual informationMasashi Sugiyama, Gang Niu, Makoto Yamada, et al.Neural Computation|March 23, 2013
Efficient sample reuse in policy gradients with parameter-based explorationTingting Zhao, Hirotaka Hachiya, Voot Tangkaratt, et al.Pageof 1