vix.ing · top · new · best · stats · spec

Yu, Huizhen

  1. On Convergence of Emphatic Temporal-Difference Learning
    2015/06/08 by Yu, Huizhen · 2 citations
    #62L20 #68W40 #90C40 #FOS: Computer and information sciences #Machine Learning (cs.LG)
  2. On Convergence of some Gradient-based Temporal-Differences Algorithms for Off-Policy Learning
    2017/12/27 by Yu, Huizhen · 2 citations
    #62L20 #68W40 #90C40 #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Optimization and Control (math.OC)
  3. A Function Approximation Approach to Estimation of Policy Gradient for POMDP with Structured Policies
    2012/07/04 by Huizhen Yu, Yu, Huizhen · 1 citation
    Computer Science · Engineering · #Advanced Control Systems Optimization #Adversarial Robustness in Machine Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics
  4. Discretized Approximations for POMDP with Average Cost
    2012/07/11 by Yu, Huizhen, Bertsekas, Dimitri · 1 citation
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #FOS: Electrical engineering #FOS: Mathematics #Optimization and Control (math.OC) #Systems and Control (eess.SY) #electronic engineering #information engineering
  5. Emphatic Temporal-Difference Learning
    2015/07/06 by Mahmood, A. Rupam, Yu, Huizhen, White, Martha +1 · 1 citation
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG)