Amortila, Philip
- Constrained Markov Decision Processes via Backward Value Functions
2020/08/26 by Satija, Harsh, Amortila, Philip, Pineau, Joelle · 4 citations
#FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Control (math.OC)
- A Variant of the Wang-Foster-Kakade Lower Bound for the Discounted Setting
2020/11/02 by Philip Amortila, Amortila, Philip, Nan Jiang +3 · 5 citations
Computer Science · Decision Sciences · #Reinforcement Learning in Robotics #Advanced Bandit Algorithms Research #Adversarial Robustness in Machine Learning
- Exponential Lower Bounds for Planning in MDPs With Linearly-Realizable\n Optimal Action-Value Functions
2020/10/03 by Gellért Weisz, Philip Amortila, Weisz, Gellért +3 · 1 citation
Computer Science · #AI-based Problem Solving and Planning #Artificial Intelligence (cs.AI) #Bayesian Modeling and Causal Inference #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #Reinforcement Learning in Robotics
- Harnessing Density Ratios for Online Reinforcement Learning
2024/01/18 by Philip Amortila, Amortila, Philip, Dylan J. Foster +7 · 1 citation
Computer Science · #Reinforcement Learning in Robotics #Machine Learning and Data Classification #Software Engineering Research
- Model Selection for Off-policy Evaluation: New Algorithms and Experimental Protocol
2025/02/11 by Pai Liu, Lingfeng Zhao, Liu, Pai +11 · 3 citations
Computer Science · Mathematics · Decision Sciences · #Reinforcement Learning in Robotics #Advanced Causal Inference Techniques #Advanced Bandit Algorithms Research