vix.ing · top · new · best · stats · spec

Scherrer, Bruno

  1. A Theory of Regularized Markov Decision Processes
    2019/01/31 by Matthieu Geist, Geist, Matthieu, Bruno Scherrer +3 · 43 citations
    Computer Science · #Adversarial Robustness in Machine Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
  2. Approximate Policy Iteration Schemes: A Comparison
    2014/05/12 by Bruno Scherrer, Scherrer, Bruno · 9 citations
    Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #Optimization and Search Problems #Reinforcement Learning in Robotics
  3. Anderson Acceleration for Reinforcement Learning
    2018/09/25 by Geist, Matthieu, Bruno Scherrer, Scherrer, Bruno · 7 citations
    Computer Science · #Adaptive Dynamic Programming Control #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Stochastic Gradient Optimization Techniques
  4. Should one compute the Temporal Difference fix point or minimize the\n Bellman Residual? The unified oblique projection view
    2010/11/19 by Bruno Scherrer, Scherrer, Bruno · 5 citations
    Computer Science · Economics, Econometrics and Finance · Mathematics · #Advanced Multi-Objective Optimization Algorithms #Artificial Intelligence (cs.AI) #Climate Change Policy and Economics #FOS: Computer and information sciences #Markov Chains and Monte Carlo Methods #Reinforcement Learning in Robotics
  5. A Dantzig Selector Approach to Temporal Difference Learning
    2012/06/27 by Matthieu Geist, Bruno Scherrer, Geist, Matthieu +5 · 4 citations
    Biochemistry, Genetics and Molecular Biology · Computer Science · #Cancer-related molecular mechanisms research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Music and Audio Processing #Speech and Audio Processing
  6. Beyond the One Step Greedy Approach in Reinforcement Learning
    2018/02/10 by Yonathan Efroni, Gal Dalal, Efroni, Yonathan +5 · 4 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #Evolutionary Algorithms and Applications #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics
  7. Improved and Generalized Upper Bounds on the Complexity of Policy Iteration
    2013/06/03 by Scherrer, Bruno · 2 citations
    #Artificial Intelligence (cs.AI) #Discrete Mathematics (cs.DM) #FOS: Computer and information sciences #FOS: Mathematics #Optimization and Control (math.OC) #Robotics (cs.RO)
  8. Leverage the Average: an Analysis of KL Regularization in RL
    2020/03/31 by Nino Vieillard, Vieillard, Nino, Tadashi Kozuno +9 · 2 citations
    Computer Science · Decision Sciences · #Reinforcement Learning in Robotics #Advanced Bandit Algorithms Research #Adaptive Dynamic Programming Control
  9. Momentum in Reinforcement Learning
    2019/10/21 by Nino Vieillard, Vieillard, Nino, Bruno Scherrer +5 · 2 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Evolutionary Algorithms and Applications #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics
  10. Off-policy Learning with Eligibility Traces: A Survey
    2013/04/15 by Matthieu Geist, Geist, Matthieu, Bruno Scherrer +1 · 1 citation
    Computer Science · Decision Sciences · #Reinforcement Learning in Robotics #Gaussian Processes and Bayesian Inference #Advanced Bandit Algorithms Research
  11. Approximate Modified Policy Iteration
    2012/01/01 by Scherrer, Bruno, Gabillon, Victor, Ghavamzadeh, Mohammad +8 · 2 citations
    Computer Science · Engineering · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Formal Methods in Verification #Fuel Cells and Related Materials #Optimization and Search Problems #Reinforcement Learning in Robotics
  12. On the Performance Bounds of some Policy Search Dynamic Programming Algorithms
    2013/01/01 by Bruno Scherrer, Scherrer, Bruno, Loria Maia Project-team +1 · 1 citation
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Optimization and Search Problems #Reinforcement Learning in Robotics
  13. How to Combine Tree-Search Methods in Reinforcement Learning
    2018/09/06 by Yonathan Efroni, Efroni, Yonathan, Gal Dalal +5 · 1 citation
    Computer Science · Decision Sciences · Economics, Econometrics and Finance · #AI-based Problem Solving and Planning #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #Artificial Intelligence in Games #FOS: Computer and information sciences #Game Theory and Voting Systems #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics
  14. Policy Search: Any Local Optimum Enjoys a Global Performance Guarantee
    2013/06/06 by Bruno Scherrer, Matthieu Geist, Scherrer, Bruno +1 · 1 citation
    Computer Science · #Artificial Intelligence (cs.AI) #Evolutionary Algorithms and Applications #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning and Algorithms #Optimization and Control (math.OC) #Reinforcement Learning in Robotics #Robotics (cs.RO)