Yunduan Cui, Takamitsu Matsubara, Kenji Sugimoto: Kernel dynamic policy programming: Applicable reinforcement learning to robot systems with high dimensional states. Neural Networks 94: 13-23 (2017)