Toshinori Kitamura
Toshinori Kitamura
Home
Experience
Posts
Projects
Teaching
Publications
CV
Light
Dark
Automatic
3
A Unified MDP Framework for Solving Robust, Convex, Multi-Discount Constraints, and Beyond
Add the full text or supplementary notes for the publication here using Markdown formatting.
Toshinori Kitamura
,
Arnob Ghosh
,
Tadashi Kozuno
,
Kenta Hoshino
,
Yohei Hosoe
,
Kazumi Kasaura
,
Wataru Kumagai
,
Paavo Parmas
,
Yutaka Matsuo
(OS 招待講演) 逐次意思決定における諸問題設定と問題に関する事前知識が性能保証に及ぼす影響について
小津野将
,
北村俊徳
,
市原有生希
,
萩原誠
KL-Entropy-Regularized RL with a Generative Model is Minimax Optimal
Tadashi Kozuno
,
Wenhao Yang
,
Nino Vieillard
,
Toshinori Kitamura
,
Yunhao Tang
,
Jincheng Mei
,
Pierre Ménard
,
Mohammad Gheshlaghi Azar
,
Michal Valko
,
Rémi Munos
,
others
Cautious Actor-Critic
Lingwei Zhu
,
Toshinori Kitamura
,
Matsubara Takamitsu
Cautious Policy Programming: Exploiting KL Regularization in Monotonic Policy Improvement for Reinforcement Learning
Lingwei Zhu
,
Toshinori Kitamura
,
Takamitsu Matsubara
Geometric Value Iteration: Dynamic Error-Aware KL Regularization for Reinforcement Learning
Toshinori Kitamura
,
Lingwei Zhu
,
Takamitsu Matsubara
ShinRL: A Library for Evaluating RL Algorithms from Theoretical and Practical Perspectives
Toshinori Kitamura
,
Ryo Yonetani
Cite
×