vix.ing · top · new · best · stats · spec

Yaqi Duan

  1. PU-Flow: a Point Cloud Upsampling Network with Normalizing Flows
    2021/07/13 by Aihua Mao, Mao, Aihua, Zihui Du +9 · 3 citations
    Computer Science · Earth and Planetary Sciences · Engineering · #3D Shape Modeling and Analysis #3D Surveying and Cultural Heritage #Computer Graphics and Visualization Techniques #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
  2. Risk Bounds and Rademacher Complexity in Batch Reinforcement Learning
    2021/03/25 by Yaqi Duan, Duan, Yaqi, Chi Jin +3 · 2 citations
    Computer Science · Engineering · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Search Problems #Reinforcement Learning in Robotics #Scheduling and Optimization Algorithms
  3. Bootstrapping Fitted Q-Evaluation for Off-Policy Inference
    2021/02/06 by Botao Hao, Xiang Ji, Hao, Botao +9 · 2 citations
    Computer Science · #FOS: Computer and information sciences #FOS: Mathematics #Formal Methods in Verification #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #Reinforcement Learning in Robotics #Statistics Theory (math.ST)
  4. PILAF: Optimal Human Preference Sampling for Reward Modeling
    2025/02/06 by Yunzhen Feng, Feng, Yunzhen, Ariel Kwiatkowski +6 · 8 citations
    Computer Science · #Data Management and Algorithms #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
  5. Near-optimal Offline Reinforcement Learning with Linear Representation:\n Leveraging Variance Information with Pessimism
    2022/03/11 by Min Yin, Yin, Ming, Yaqi Duan +6 · 2 citations
    Computer Science · Decision Sciences · Energy · #Advanced Bandit Algorithms Research #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #Energy Efficiency and Management #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Stochastic Gradient Optimization Techniques
  6. Localized exploration in contextual dynamic pricing achieves dimension-free regret
    2024/12/26 by Yaqi Duan, Chai, Jinhang, Jianqing Fan +4 · 1 citation
    Physics and Astronomy · Decision Sciences · #Opinion Dynamics and Social Influence #Decision-Making and Behavioral Economics
  7. Don't Waste Mistakes: Leveraging Negative RL-Groups via Confidence Reweighting
    2025/10/09 by Yunzhen Feng, Parag Jain, Feng, Yunzhen +7 · 2 citations
    Computer Science · #Natural Language Processing Techniques
  8. Taming "data-hungry" reinforcement learning? Stability in continuous state-action spaces
    2024/01/10 by Yaqi Duan, Martin J. Wainwright, Duan, Yaqi +1 · 1 citation
    Computer Science · #FOS: Computer and information sciences #FOS: Electrical engineering #FOS: Mathematics #Information Theory (cs.IT) #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Control (math.OC) #Reinforcement Learning in Robotics #Systems and Control (eess.SY) #electronic engineering #information engineering