vix.ing · top · new · best · stats · spec

Xiaoyang Tan

  1. Truly Proximal Policy Optimization
    2019/03/19 by Yuhui Wang, Hao He, Wang, Yuhui +5 · 15 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Search Problems #Reinforcement Learning in Robotics
  2. Trust Region-Guided Proximal Policy Optimization
    2019/01/29 by Yuhui Wang, Wang, Yuhui, Hao He +5 · 6 citations
    Computer Science · #Advanced Neural Network Applications #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and ELM #Reinforcement Learning in Robotics
  3. SMIX(λ): Enhancing Centralized Value Functions for Cooperative Multi-Agent Reinforcement Learning
    2019/11/11 by Xinghu Yao, Yao, Xinghu, Chao Wen +5 · 3 citations
    Computer Science · Engineering · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics #Traffic control and management
  4. HiQA: A Hierarchical Contextual Augmentation RAG for Multi-Documents QA
    2024/02/01 by Xinyue Chen, Pengyu Gao, Chen, Xinyue +5 · 2 voices · 3 citations
    Computer Science · #Natural Language Processing Techniques #cs.AI #cs.CL #cs.LG
  5. Robust Reinforcement Learning in POMDPs with Incomplete and Noisy Observations
    2019/02/15 by Yuhui Wang, Wang, Yuhui, Hao He +3 · 2 citations
    Computer Science · Engineering · #Adaptive Dynamic Programming Control #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Fault Detection and Control Systems #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and ELM
  6. Stabilizing Q Learning Via Soft Mellowmax Operator
    2020/12/17 by Yaozhong Gan, Zhe Zhang, Gan, Yaozhong +3 · 2 citations
    Computer Science · #Adaptive Dynamic Programming Control #Adversarial Robustness in Machine Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics