vix.ing · top · new · best · stats · spec

Mehdi Jafarnia-Jahromi

  1. Model-free Reinforcement Learning in Infinite-horizon Average-reward Markov Decision Processes
    2019/10/15 by Chen-Yu Wei, Mehdi Jafarnia-Jahromi, Wei, Chen-Yu +7 · 2 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Age of Information Optimization #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics