Csaba Szepesvari
- Learning with a Strong Adversary
2015/11/10 by Ruitong Huang, Bing Xu, Huang, Ruitong +6 · 34 citations
Computer Science · #Adversarial Robustness in Machine Learning #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #cs.LG
- Online Least Squares Estimation with Self-Normalized Processes: An Application to Bandit Problems
2011/02/14 by Yasin Abbasi-Yadkori, Abbasi-Yadkori, Yasin, Dávid Pál +5 · 14 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Optimization and Search Problems #Reinforcement Learning in Robotics #cs.AI
- Cascading Bandits: Learning to Rank in the Cascade Model
2015/02/10 by Branislav Kveton, Csaba Szepesvári, Kveton, Branislav +6 · 14 citations
Computer Science · Decision Sciences · Mathematics · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #Optimization and Search Problems #cs.LG #stat.ML
- Apprenticeship Learning using Inverse Reinforcement Learning and Gradient Methods
2012/06/20 by Gergely Neu, Csaba Szepesvári, Neu, Gergely +2 · 14 citations
Computer Science · Mathematics · #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and ELM #Reinforcement Learning in Robotics #cs.LG #stat.ML
- Combinatorial Cascading Bandits
2015/07/15 by Branislav Kveton, Kveton, Branislav, Zheng Wen +6 · 11 citations
Computer Science · Decision Sciences · Mathematics · #Advanced Bandit Algorithms Research #Optimization and Search Problems #Reinforcement Learning in Robotics #cs.LG #stat.ML
- Analysis of Kernel Mean Matching under Covariate Shift
2012/06/18 by Yaoliang Yu, Yu, Yaoliang, Csaba Szepesvari +2 · 9 citations
Computer Science · Mathematics · #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Face and Expression Recognition #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #cs.LG #stat.ML
- The End of Optimism? An Asymptotic Analysis of Finite-Armed Linear Bandits
2016/10/14 by Tor Lattimore, Lattimore, Tor, Csaba Szepesvari +1 · 6 citations
Computer Science · Mathematics · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #cs.LG #stat.ML
- An Adaptive Algorithm for Finite Stochastic Partial Monitoring
2012/06/27 by Gábor Bartók, Gabor Bartok, Bartok, Gabor +5 · 6 citations
Computer Science · Decision Sciences · Mathematics · #Advanced Bandit Algorithms Research #Computer Science and Game Theory (cs.GT) #Data Stream Mining Techniques #FOS: Computer and information sciences #Gaussian Processes and Bayesian Inference #Machine Learning (cs.LG) #Machine Learning (stat.ML) #cs.GT #cs.LG #stat.ML
- Bayesian Optimal Control of Smoothly Parameterized Systems: The Lazy Posterior Sampling Algorithm
2014/06/16 by Yasin Abbasi-Yadkori, Csaba Szepesvari, Abbasi-Yadkori, Yasin +2 · 5 citations
Computer Science · Decision Sciences · Engineering · Mathematics · #Advanced Bandit Algorithms Research #Advanced Control Systems Optimization #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Markov Chains and Monte Carlo Methods #Reinforcement Learning in Robotics #cs.LG #stat.ML
- PAC-Bayesian Policy Evaluation for Reinforcement Learning
2012/02/14 by Mahdi MIlani Fard, Mahdi Milani Fard, Fard, Mahdi MIlani +6 · 4 citations
Computer Science · Mathematics · #Domain Adaptation and Few-Shot Learning #Machine Learning and Algorithms #Reinforcement Learning in Robotics #cs.LG #stat.ML
- Online Learning in Markov Decision Processes with Adversarially Chosen Transition Probability Distributions
2013/03/12 by Yasin Abbasi-Yadkori, Peter L. Bartlett, Abbasi-Yadkori, Yasin +4 · 2 citations
Computer Science · Decision Sciences · Mathematics · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #Reinforcement Learning in Robotics #cs.LG #stat.ML
- Statistical Linear Estimation with Penalized Estimators: an Application to Reinforcement Learning
2012/06/27 by Bernardo Avila Pires, Pires, Bernardo Avila, Csaba Szepesvari +1 · 1 citation
Computer Science · Mathematics · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #cs.LG #stat.ML
- On Minimax Optimal Offline Policy Evaluation
2014/09/12 by Lihong Li, Remi Munos, Rémi Munos +5 · 2 citations
Computer Science · Decision Sciences · Mathematics · #Advanced Bandit Algorithms Research #Advanced Causal Inference Techniques #Age of Information Optimization #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #I.2.6 #cs.AI
- Sequential Learning without Feedback
2016/10/18 by Manjesh Hanawal, Manjesh K. Hanawal, Hanawal, Manjesh +5 · 1 citation
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Distributed Sensor Networks and Detection Algorithms #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and Algorithms #cs.LG