vix.ing · top · new · best · stats · spec

Csaba Szepesvari

  1. Learning with a Strong Adversary
    2015/11/10 by Ruitong Huang, Bing Xu, Huang, Ruitong +6 · 34 citations
    Computer Science · #Adversarial Robustness in Machine Learning #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #cs.LG
  2. Online Least Squares Estimation with Self-Normalized Processes: An Application to Bandit Problems
    2011/02/14 by Yasin Abbasi-Yadkori, Abbasi-Yadkori, Yasin, Dávid Pál +5 · 14 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Optimization and Search Problems #Reinforcement Learning in Robotics #cs.AI
  3. Cascading Bandits: Learning to Rank in the Cascade Model
    2015/02/10 by Branislav Kveton, Csaba Szepesvári, Kveton, Branislav +6 · 14 citations
    Computer Science · Decision Sciences · Mathematics · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #Optimization and Search Problems #cs.LG #stat.ML
  4. Apprenticeship Learning using Inverse Reinforcement Learning and Gradient Methods
    2012/06/20 by Gergely Neu, Csaba Szepesvári, Neu, Gergely +2 · 14 citations
    Computer Science · Mathematics · #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and ELM #Reinforcement Learning in Robotics #cs.LG #stat.ML
  5. Combinatorial Cascading Bandits
    2015/07/15 by Branislav Kveton, Kveton, Branislav, Zheng Wen +6 · 11 citations
    Computer Science · Decision Sciences · Mathematics · #Advanced Bandit Algorithms Research #Optimization and Search Problems #Reinforcement Learning in Robotics #cs.LG #stat.ML
  6. Analysis of Kernel Mean Matching under Covariate Shift
    2012/06/18 by Yaoliang Yu, Yu, Yaoliang, Csaba Szepesvari +2 · 9 citations
    Computer Science · Mathematics · #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Face and Expression Recognition #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #cs.LG #stat.ML
  7. The End of Optimism? An Asymptotic Analysis of Finite-Armed Linear Bandits
    2016/10/14 by Tor Lattimore, Lattimore, Tor, Csaba Szepesvari +1 · 6 citations
    Computer Science · Mathematics · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #cs.LG #stat.ML
  8. An Adaptive Algorithm for Finite Stochastic Partial Monitoring
    2012/06/27 by Gábor Bartók, Gabor Bartok, Bartok, Gabor +5 · 6 citations
    Computer Science · Decision Sciences · Mathematics · #Advanced Bandit Algorithms Research #Computer Science and Game Theory (cs.GT) #Data Stream Mining Techniques #FOS: Computer and information sciences #Gaussian Processes and Bayesian Inference #Machine Learning (cs.LG) #Machine Learning (stat.ML) #cs.GT #cs.LG #stat.ML
  9. Bayesian Optimal Control of Smoothly Parameterized Systems: The Lazy Posterior Sampling Algorithm
    2014/06/16 by Yasin Abbasi-Yadkori, Csaba Szepesvari, Abbasi-Yadkori, Yasin +2 · 5 citations
    Computer Science · Decision Sciences · Engineering · Mathematics · #Advanced Bandit Algorithms Research #Advanced Control Systems Optimization #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Markov Chains and Monte Carlo Methods #Reinforcement Learning in Robotics #cs.LG #stat.ML
  10. PAC-Bayesian Policy Evaluation for Reinforcement Learning
    2012/02/14 by Mahdi MIlani Fard, Mahdi Milani Fard, Fard, Mahdi MIlani +6 · 4 citations
    Computer Science · Mathematics · #Domain Adaptation and Few-Shot Learning #Machine Learning and Algorithms #Reinforcement Learning in Robotics #cs.LG #stat.ML
  11. Online Learning in Markov Decision Processes with Adversarially Chosen Transition Probability Distributions
    2013/03/12 by Yasin Abbasi-Yadkori, Peter L. Bartlett, Abbasi-Yadkori, Yasin +4 · 2 citations
    Computer Science · Decision Sciences · Mathematics · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #Reinforcement Learning in Robotics #cs.LG #stat.ML
  12. Statistical Linear Estimation with Penalized Estimators: an Application to Reinforcement Learning
    2012/06/27 by Bernardo Avila Pires, Pires, Bernardo Avila, Csaba Szepesvari +1 · 1 citation
    Computer Science · Mathematics · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #cs.LG #stat.ML
  13. On Minimax Optimal Offline Policy Evaluation
    2014/09/12 by Lihong Li, Remi Munos, Rémi Munos +5 · 2 citations
    Computer Science · Decision Sciences · Mathematics · #Advanced Bandit Algorithms Research #Advanced Causal Inference Techniques #Age of Information Optimization #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #I.2.6 #cs.AI
  14. Sequential Learning without Feedback
    2016/10/18 by Manjesh Hanawal, Manjesh K. Hanawal, Hanawal, Manjesh +5 · 1 citation
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Distributed Sensor Networks and Detection Algorithms #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and Algorithms #cs.LG