Yu, Huizhen
- On Convergence of Emphatic Temporal-Difference Learning
2015/06/08 by Yu, Huizhen · 2 citations
#62L20 #68W40 #90C40 #FOS: Computer and information sciences #Machine Learning (cs.LG)
- On Convergence of some Gradient-based Temporal-Differences Algorithms for Off-Policy Learning
2017/12/27 by Yu, Huizhen · 2 citations
#62L20 #68W40 #90C40 #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Optimization and Control (math.OC)
- A Function Approximation Approach to Estimation of Policy Gradient for POMDP with Structured Policies
2012/07/04 by Huizhen Yu, Yu, Huizhen · 1 citation
Computer Science · Engineering · #Advanced Control Systems Optimization #Adversarial Robustness in Machine Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics
- Discretized Approximations for POMDP with Average Cost
2012/07/11 by Yu, Huizhen, Bertsekas, Dimitri · 1 citation
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #FOS: Electrical engineering #FOS: Mathematics #Optimization and Control (math.OC) #Systems and Control (eess.SY) #electronic engineering #information engineering
- Emphatic Temporal-Difference Learning
2015/07/06 by Mahmood, A. Rupam, Yu, Huizhen, White, Martha +1 · 1 citation
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG)