2015/12/30 by Philip S. Thomas, Thomas, Philip S., Billy Okal +1 · 1 citation
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Reinforcement Learning in Robotics #Simulation Techniques and Applications #cs.AI
paper · pdf · doi:10.48550/arxiv.1512.09075
openalex publication_date 2015/12/30 · arxiv created 2016/09/08 · arxiv updated 2016/09/09 · openalex created_date 2025/10/10 · openalex updated_date 2026/07/28
This paper specifies a notation for Markov decision processes.