Scherrer, Bruno
- A Theory of Regularized Markov Decision Processes
2019/01/31 by Matthieu Geist, Geist, Matthieu, Bruno Scherrer +3 · 43 citations
Computer Science · #Adversarial Robustness in Machine Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
- Approximate Policy Iteration Schemes: A Comparison
2014/05/12 by Bruno Scherrer, Scherrer, Bruno · 9 citations
Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #Optimization and Search Problems #Reinforcement Learning in Robotics
- Anderson Acceleration for Reinforcement Learning
2018/09/25 by Geist, Matthieu, Bruno Scherrer, Scherrer, Bruno · 7 citations
Computer Science · #Adaptive Dynamic Programming Control #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Stochastic Gradient Optimization Techniques
- Should one compute the Temporal Difference fix point or minimize the\n Bellman Residual? The unified oblique projection view
2010/11/19 by Bruno Scherrer, Scherrer, Bruno · 5 citations
Computer Science · Economics, Econometrics and Finance · Mathematics · #Advanced Multi-Objective Optimization Algorithms #Artificial Intelligence (cs.AI) #Climate Change Policy and Economics #FOS: Computer and information sciences #Markov Chains and Monte Carlo Methods #Reinforcement Learning in Robotics
- A Dantzig Selector Approach to Temporal Difference Learning
2012/06/27 by Matthieu Geist, Bruno Scherrer, Geist, Matthieu +5 · 4 citations
Biochemistry, Genetics and Molecular Biology · Computer Science · #Cancer-related molecular mechanisms research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Music and Audio Processing #Speech and Audio Processing
- Beyond the One Step Greedy Approach in Reinforcement Learning
2018/02/10 by Yonathan Efroni, Gal Dalal, Efroni, Yonathan +5 · 4 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #Evolutionary Algorithms and Applications #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics
- Improved and Generalized Upper Bounds on the Complexity of Policy Iteration
2013/06/03 by Scherrer, Bruno · 2 citations
#Artificial Intelligence (cs.AI) #Discrete Mathematics (cs.DM) #FOS: Computer and information sciences #FOS: Mathematics #Optimization and Control (math.OC) #Robotics (cs.RO)
- Leverage the Average: an Analysis of KL Regularization in RL
2020/03/31 by Nino Vieillard, Vieillard, Nino, Tadashi Kozuno +9 · 2 citations
Computer Science · Decision Sciences · #Reinforcement Learning in Robotics #Advanced Bandit Algorithms Research #Adaptive Dynamic Programming Control
- Momentum in Reinforcement Learning
2019/10/21 by Nino Vieillard, Vieillard, Nino, Bruno Scherrer +5 · 2 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Evolutionary Algorithms and Applications #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics
- Off-policy Learning with Eligibility Traces: A Survey
2013/04/15 by Matthieu Geist, Geist, Matthieu, Bruno Scherrer +1 · 1 citation
Computer Science · Decision Sciences · #Reinforcement Learning in Robotics #Gaussian Processes and Bayesian Inference #Advanced Bandit Algorithms Research
- Approximate Modified Policy Iteration
2012/01/01 by Scherrer, Bruno, Gabillon, Victor, Ghavamzadeh, Mohammad +8 · 2 citations
Computer Science · Engineering · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Formal Methods in Verification #Fuel Cells and Related Materials #Optimization and Search Problems #Reinforcement Learning in Robotics
- On the Performance Bounds of some Policy Search Dynamic Programming Algorithms
2013/01/01 by Bruno Scherrer, Scherrer, Bruno, Loria Maia Project-team +1 · 1 citation
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Optimization and Search Problems #Reinforcement Learning in Robotics
- How to Combine Tree-Search Methods in Reinforcement Learning
2018/09/06 by Yonathan Efroni, Efroni, Yonathan, Gal Dalal +5 · 1 citation
Computer Science · Decision Sciences · Economics, Econometrics and Finance · #AI-based Problem Solving and Planning #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #Artificial Intelligence in Games #FOS: Computer and information sciences #Game Theory and Voting Systems #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics
- Policy Search: Any Local Optimum Enjoys a Global Performance Guarantee
2013/06/06 by Bruno Scherrer, Matthieu Geist, Scherrer, Bruno +1 · 1 citation
Computer Science · #Artificial Intelligence (cs.AI) #Evolutionary Algorithms and Applications #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning and Algorithms #Optimization and Control (math.OC) #Reinforcement Learning in Robotics #Robotics (cs.RO)