vix.ing · top · new · best · stats · spec

Weng, Paul

  1. A Survey of Reinforcement Learning from Human Feedback
    2023/12/22 by Timo Kaufmann, Kaufmann, Timo, Paul Weng +5 · 65 citations
    Computer Science · #FOS: Computer and information sciences #I.2.6 #Machine Learning (cs.LG) #Software Engineering Research
  2. A Survey on Interpretable Reinforcement Learning
    2021/12/24 by Claire Glanois, Paul Weng, Glanois, Claire +11 · 12 citations
    Computer Science · #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #Explainable Artificial Intelligence (XAI) #FOS: Computer and information sciences #I.2.6 #Machine Learning (cs.LG)
  3. Multi-objective Bandits: Optimizing the Generalized Gini Index
    2017/06/15 by Busa-Fekete, Robert, Szorenyi, Balazs, Weng, Paul +1 · 5 citations
    #FOS: Computer and information sciences #Machine Learning (cs.LG)
  4. Learning Fair Policies in Decentralized Cooperative Multi-Agent Reinforcement Learning
    2020/12/17 by Zimmer, Matthieu, Glanois, Claire, Siddique, Umer +1 · 5 citations
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multiagent Systems (cs.MA)
  5. Neuro-Symbolic Hierarchical Rule Induction
    2021/12/26 by Claire Glanois, Xuening Feng, Glanois, Claire +9 · 5 citations
    Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #I.2.3 #I.2.6 #Machine Learning (cs.LG) #Multimodal Machine Learning Applications #Reinforcement Learning in Robotics #Topic Modeling
  6. INViT: A Generalizable Routing Problem Solver with Invariant Nested View Transformer
    2024/02/04 by Fang, Han, Song, Zhihao, Weng, Paul +1 · 7 citations
    #FOS: Computer and information sciences #Machine Learning (cs.LG)
  7. Learning Fair Policies in Multiobjective (Deep) Reinforcement Learning\n with Average and Discounted Rewards
    2020/08/18 by Umer Siddique, Paul Weng, Siddique, Umer +3 · 4 citations
    Computer Science · Social Sciences · Business, Management and Accounting · #Reinforcement Learning in Robotics #Experimental Behavioral Economics Studies #Supply Chain and Inventory Management
  8. Generalization in Deep RL for TSP Problems via Equivariance and Local Search
    2021/10/07 by Wenbin Ouyang, Yisen Wang, Ouyang, Wenbin +5 · 2 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Evolutionary Algorithms and Applications #FOS: Computer and information sciences #Machine Learning (cs.LG) #Metaheuristic Optimization Algorithms Research #Reinforcement Learning in Robotics
  9. Optimizing Quantiles in Preference-based Markov Decision Processes
    2016/12/01 by Gilbert, Hugo, Weng, Paul, Xu, Yan · 1 citation
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences
  10. Analytics and Machine Learning in Vehicle Routing Research
    2021/02/19 by Bai, Ruibin, Chen, Xinan, Chen, Zhi-Long +13 · 1 citation
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Optimization and Control (math.OC)
  11. Differentiable Logic Machines
    2021/02/23 by Zimmer, Matthieu, Feng, Xuening, Glanois, Claire +6 · 1 citation
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences
  12. Improving Generalization of Deep Reinforcement Learning-based TSP Solvers
    2021/10/06 by Wenbin Ouyang, Yisen Wang, Ouyang, Wenbin +7 · 1 citation
    Engineering · Computer Science · #Vehicle Routing Optimization Methods #Metaheuristic Optimization Algorithms Research #Reinforcement Learning in Robotics
  13. Revisiting Data Augmentation in Deep Reinforcement Learning
    2024/02/19 by Jianshu Hu, Yunpeng Jiang, Hu, Jianshu +3 · 1 citation
    Computer Science · #Reinforcement Learning in Robotics
  14. Reinforcement Learning From Imperfect Corrective Actions And Proxy Rewards
    2024/10/08 by Zhaohui Jiang, Jiang, Zhaohui, Xuening Feng +15 · 1 citation
    Computer Science · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
  15. Imitation Learning from Suboptimal Demonstrations via Meta-Learning An Action Ranker
    2024/12/28 by Hongcai He, Fan, Jiangdong, He, Hongcai +6 · 1 citation
    Computer Science · #Machine Learning and Data Classification #Human Pose and Action Recognition #Adversarial Robustness in Machine Learning