Du, Yihan
- Provably Safe Reinforcement Learning with Step-wise Violation Constraints
2023/02/13 by Nuoya Xiong, Xiong, Nuoya, Yihan du +3 · 2 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Adversarial Robustness in Machine Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
- Exploration-Driven Policy Optimization in RLHF: Theoretical Insights on Efficient Data Utilization
2024/02/15 by Yihan Du, Anna Winnicki, Du, Yihan +7 · 2 citations
Engineering · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reservoir Engineering and Simulation Methods
- Provably Efficient Risk-Sensitive Reinforcement Learning: Iterated CVaR and Worst Path
2022/06/06 by Du, Yihan, Wang, Siwei, Huang, Longbo · 1 citation
#FOS: Computer and information sciences #Machine Learning (cs.LG)
- Dueling Bandits: From Two-dueling to Multi-dueling
2022/11/16 by Yihan Du, Du, Yihan, Siwei Wang +3 · 1 citation
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Adversarial Robustness in Machine Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
- Provably Efficient Iterated CVaR Reinforcement Learning with Function Approximation and Human Feedback
2023/07/06 by Chen, Yu, Du, Yihan, Hu, Pihe +3 · 1 citation
#FOS: Computer and information sciences #Machine Learning (cs.LG)
- Cascading Reinforcement Learning
2024/01/17 by Du, Yihan, Srikant, R., Chen, Wei · 1 citation
#FOS: Computer and information sciences #Machine Learning (cs.LG)