Yaqi Duan
- PU-Flow: a Point Cloud Upsampling Network with Normalizing Flows
2021/07/13 by Aihua Mao, Mao, Aihua, Zihui Du +9 · 3 citations
Computer Science · Earth and Planetary Sciences · Engineering · #3D Shape Modeling and Analysis #3D Surveying and Cultural Heritage #Computer Graphics and Visualization Techniques #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
- Risk Bounds and Rademacher Complexity in Batch Reinforcement Learning
2021/03/25 by Yaqi Duan, Duan, Yaqi, Chi Jin +3 · 2 citations
Computer Science · Engineering · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Search Problems #Reinforcement Learning in Robotics #Scheduling and Optimization Algorithms
- Bootstrapping Fitted Q-Evaluation for Off-Policy Inference
2021/02/06 by Botao Hao, Xiang Ji, Hao, Botao +9 · 2 citations
Computer Science · #FOS: Computer and information sciences #FOS: Mathematics #Formal Methods in Verification #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #Reinforcement Learning in Robotics #Statistics Theory (math.ST)
- PILAF: Optimal Human Preference Sampling for Reward Modeling
2025/02/06 by Yunzhen Feng, Feng, Yunzhen, Ariel Kwiatkowski +6 · 8 citations
Computer Science · #Data Management and Algorithms #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
- Near-optimal Offline Reinforcement Learning with Linear Representation:\n Leveraging Variance Information with Pessimism
2022/03/11 by Min Yin, Yin, Ming, Yaqi Duan +6 · 2 citations
Computer Science · Decision Sciences · Energy · #Advanced Bandit Algorithms Research #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #Energy Efficiency and Management #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Stochastic Gradient Optimization Techniques
- Localized exploration in contextual dynamic pricing achieves dimension-free regret
2024/12/26 by Yaqi Duan, Chai, Jinhang, Jianqing Fan +4 · 1 citation
Physics and Astronomy · Decision Sciences · #Opinion Dynamics and Social Influence #Decision-Making and Behavioral Economics
- Don't Waste Mistakes: Leveraging Negative RL-Groups via Confidence Reweighting
2025/10/09 by Yunzhen Feng, Parag Jain, Feng, Yunzhen +7 · 2 citations
Computer Science · #Natural Language Processing Techniques
- Taming "data-hungry" reinforcement learning? Stability in continuous state-action spaces
2024/01/10 by Yaqi Duan, Martin J. Wainwright, Duan, Yaqi +1 · 1 citation
Computer Science · #FOS: Computer and information sciences #FOS: Electrical engineering #FOS: Mathematics #Information Theory (cs.IT) #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Control (math.OC) #Reinforcement Learning in Robotics #Systems and Control (eess.SY) #electronic engineering #information engineering