Peter Auer
- The Nonstochastic Multiarmed Bandit Problem
2002/01/01 by Peter Auer, Nicolò Cesa-Bianchi, Nicolò Cesa‐Bianchi +2 · 322 citations
Decision Sciences · Computer Science · #Advanced Bandit Algorithms Research #Auction Theory and Applications #Machine Learning and Algorithms
- Upper-Confidence-Bound Algorithms for Active Learning in Multi-Armed Bandits
2015/07/16 by Alexandra Carpentier, Carpentier, Alexandra, Alessandro Lazaric +9 · 6 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Data Stream Mining Techniques #FOS: Computer and information sciences #G.3 #Machine Learning (cs.LG) #Machine Learning and Algorithms
- A Sliding-Window Algorithm for Markov Decision Processes with\n Arbitrarily Changing Rewards and Transitions
2018/05/25 by Pratik Gajane, Ronald Ortner, Gajane, Pratik +3 · 9 citations
Computer Science · Decision Sciences · Engineering · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Smart Grid Energy Management
- PAC-Bayes-Bernstein Inequality for Martingales and its Application to\n Multiarmed Bandits
2011/10/31 by Yevgeny Seldin, Seldin, Yevgeny, Nicolò Cesa‐Bianchi +7 · 2 citations
Computer Science · Decision Sciences · Engineering · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and Algorithms #Smart Grid Energy Management
- PAC-Bayesian Analysis of the Exploration-Exploitation Trade-off
2011/05/23 by Yevgeny Seldin, Seldin, Yevgeny, Nicolò Cesa‐Bianchi +9 · 1 citation
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #Reinforcement Learning in Robotics
- Autonomous exploration for navigating in non-stationary CMPs
2019/10/18 by Pratik Gajane, Ronald Ortner, Gajane, Pratik +5 · 2 citations
Computer Science · #Data Stream Mining Techniques #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #Reinforcement Learning in Robotics
- An algorithm with nearly optimal pseudo-regret for both stochastic and adversarial bandits
2016/05/27 by Peter Auer, Chao-Kai Chiang, Auer, Peter +1 · 1 citation
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Data Stream Mining Techniques #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
- The vowel space of multiethnolectal (Stuttgart) German
2024/10/01 by Daniel Duran, Daniel Durán, Peter Auer · 1 citation
Arts and Humanities · Psychology · Social Sciences · #Linguistic Variation and Morphology #Linguistic research and analysis #Phonetics and Phonology Research