W. Sun
- Corruption-robust exploration in episodic reinforcement learning
2019/11/20 by Thodoris Lykouris, Lykouris, Thodoris, Max Simchowitz +5 · 5 citations
Computer Science · Decision Sciences · Engineering · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #Data Structures and Algorithms (cs.DS) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Smart Grid Energy Management
- Pessimistic Model-based Offline Reinforcement Learning under Partial Coverage
2021/07/13 by Masatoshi Uehara, W. Sun, Uehara, Masatoshi +1 · 4 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #Reinforcement Learning in Robotics
- Representation Learning for Online and Offline RL in Low-rank MDPs
2021/10/09 by Masatoshi Uehara, Uehara, Masatoshi, Xuezhou Zhang +3 · 3 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #Reinforcement Learning in Robotics
- Constrained episodic reinforcement learning in concave-convex and knapsack settings
2020/06/09 by Kianté Brantley, Brantley, Kianté, Miroslav Dudı́k +11 · 3 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #Data Structures and Algorithms (cs.DS) #Evolutionary Algorithms and Applications #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics
- KARMA: Augmenting Embodied AI Agents with Long-and-short Term Memory Systems
2024/09/23 by Zixuan Wang, Bo Yu, Wang, Zixuan +14 · 5 citations
Computer Science · #Human Pose and Action Recognition
- Mitigating Covariate Shift in Imitation Learning via Offline Data Without Great Coverage
2021/06/06 by Jonathan Chang, Chang, Jonathan D., Masatoshi Uehara +7 · 3 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #Reinforcement Learning in Robotics