Xiaoyang Tan
- Truly Proximal Policy Optimization
2019/03/19 by Yuhui Wang, Hao He, Wang, Yuhui +5 · 15 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Search Problems #Reinforcement Learning in Robotics
- Trust Region-Guided Proximal Policy Optimization
2019/01/29 by Yuhui Wang, Wang, Yuhui, Hao He +5 · 6 citations
Computer Science · #Advanced Neural Network Applications #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and ELM #Reinforcement Learning in Robotics
- SMIX(λ): Enhancing Centralized Value Functions for Cooperative Multi-Agent Reinforcement Learning
2019/11/11 by Xinghu Yao, Yao, Xinghu, Chao Wen +5 · 3 citations
Computer Science · Engineering · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics #Traffic control and management
- HiQA: A Hierarchical Contextual Augmentation RAG for Multi-Documents QA
2024/02/01 by Xinyue Chen, Pengyu Gao, Chen, Xinyue +5 · 2 voices · 3 citations
Computer Science · #Natural Language Processing Techniques #cs.AI #cs.CL #cs.LG
- Robust Reinforcement Learning in POMDPs with Incomplete and Noisy Observations
2019/02/15 by Yuhui Wang, Wang, Yuhui, Hao He +3 · 2 citations
Computer Science · Engineering · #Adaptive Dynamic Programming Control #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Fault Detection and Control Systems #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and ELM
- Stabilizing Q Learning Via Soft Mellowmax Operator
2020/12/17 by Yaozhong Gan, Zhe Zhang, Gan, Yaozhong +3 · 2 citations
Computer Science · #Adaptive Dynamic Programming Control #Adversarial Robustness in Machine Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics