vix.ing · top · new · best · stats

Between MDPs and semi-MDPs: A framework for temporal abstraction in reinforcement learning

1999/08/01 by Richard S. Sutton, Doina Precup, Satinder Singh · 3,169 citations
Computer Science · Mathematics · #Abstraction #Action (physics) #Advanced Software Engineering Methodologies #Artificial intelligence #Computer science #Dynamic programming #Formal Methods in Verification #Machine learning #Markov decision process #Markov process #Mathematics #Process (computing) #Programming language #Reinforcement Learning in Robotics #Reinforcement learning #Set (abstract data type)

paper · pdf · doi:10.1016/s0004-3702(99)00052-1

published in Artificial Intelligence 112(1-2), 181-211 (Elsevier BV)

openalex publication_date 1999/08/01 · openalex created_date 2025/10/10 · openalex updated_date 2026/08/04

Citations

Cited by