Kozuno, Tadashi
- Greedification Operators for Policy Optimization: Investigating Forward and Reverse KL Divergences
2021/07/17 by Chan, Alan, Silva, Hugo, Lim, Sungsu +3 · 6 citations
#FOS: Computer and information sciences #Machine Learning (cs.LG)
- When to Replan? An Adaptive Replanning Strategy for Autonomous Navigation using Deep Reinforcement Learning
2023/04/24 by Honda, Kohei, Yonetani, Ryo, Nishimura, Mai +1 · 3 citations
#FOS: Computer and information sciences #Robotics (cs.RO)
- Leverage the Average: an Analysis of KL Regularization in RL
2020/03/31 by Nino Vieillard, Tadashi Kozuno, Vieillard, Nino +9 · 2 citations
Computer Science · Decision Sciences · #Reinforcement Learning in Robotics #Advanced Bandit Algorithms Research #Adaptive Dynamic Programming Control
- Policy Information Capacity: Information-Theoretic Measure for Task\n Complexity in Deep Reinforcement Learning
2021/03/23 by Hiroki Furuta, Tatsuya Matsushima, Furuta, Hiroki +11 · 2 citations
Computer Science · #Reinforcement Learning in Robotics
- Near-Optimal Policy Identification in Robust Constrained Markov Decision Processes via Epigraph Form
2024/08/29 by Toshinori Kitamura, Kitamura, Toshinori, Tadashi Kozuno +15 · 4 citations
Computer Science · Mathematics · #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Markov Chains and Monte Carlo Methods #Optimization and Control (math.OC) #Reinforcement Learning in Robotics #Statistical Methods and Inference
- Robust Markov Decision Processes without Model Estimation
2023/02/02 by Wenhao Yang, Yang, Wenhao, Han Wang +7 · 2 citations
Computer Science · #Bayesian Modeling and Causal Inference #FOS: Computer and information sciences #Gaussian Processes and Bayesian Inference #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms
- Multi-Agent Behavior Retrieval: Retrieval-Augmented Policy Training for Cooperative Push Manipulation by Mobile Robots
2023/12/04 by Kuroki, So, Nishimura, Mai, Kozuno, Tadashi · 2 citations
#FOS: Computer and information sciences #Robotics (cs.RO)
- Revisiting Peng's Q(λ) for Modern Reinforcement Learning
2021/02/27 by Tadashi Kozuno, Kozuno, Tadashi, Yunhao Tang +13 · 1 citation
Computer Science · #Artificial Intelligence (cs.AI) #Evolutionary Algorithms and Applications #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Search Problems #Reinforcement Learning in Robotics
- Symmetry-aware Reinforcement Learning for Robotic Assembly under Partial Observability with a Soft Wrist
2024/02/28 by Nguyen, Hai, Kozuno, Tadashi, Beltran-Hernandez, Cristian C. +1 · 2 citations
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Robotics (cs.RO)
- Confident Approximate Policy Iteration for Efficient Local Planning in qπ-realizable MDPs
2022/10/27 by Gellért Weisz, Weisz, Gellért, András György +5 · 1 citation
Computer Science · #Machine Learning and Algorithms #Reinforcement Learning in Robotics #Optimization and Search Problems
- Adapting to game trees in zero-sum imperfect information games
2022/12/23 by Côme Fiegel, Pierre Ménard, Fiegel, Côme +8 · 1 citation
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Artificial Intelligence in Games #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics