Mehdi Jafarnia-Jahromi
- Model-free Reinforcement Learning in Infinite-horizon Average-reward Markov Decision Processes
2019/10/15 by Chen-Yu Wei, Mehdi Jafarnia-Jahromi, Wei, Chen-Yu +7 · 2 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Age of Information Optimization #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics