vix.ing · top · new · best · stats · spec

Julian Zimmert

  1. Beating Stochastic and Adversarial Semi-bandits Optimally and Simultaneously
    2019/01/25 by Julian Zimmert, Haipeng Luo, Zimmert, Julian +3 · 7 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #Optimization and Search Problems
  2. Adapting to Misspecification in Contextual Bandits
    2021/07/12 by Dylan J. Foster, Claudio Gentile, Foster, Dylan J. +5 · 10 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Explainable Artificial Intelligence (XAI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms
  3. An Optimal Algorithm for Adversarial Bandits with Arbitrary Delays
    2019/10/14 by Julian Zimmert, Zimmert, Julian, Yevgeny Seldin +1 · 6 citations
    Decision Sciences · Computer Science · #Advanced Bandit Algorithms Research #Machine Learning and Algorithms #Stochastic Gradient Optimization Techniques
  4. Beyond Value-Function Gaps: Improved Instance-Dependent Regret Bounds\n for Episodic Reinforcement Learning
    2021/07/02 by Christoph Dann, Dann, Christoph, Teodor V. Marinov +5 · 5 citations
    Computer Science · Decision Sciences · Engineering · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics #Smart Grid Energy Management
  5. Model Selection in Contextual Stochastic Bandit Problems
    2020/03/03 by Aldo Pacchiano, Pacchiano, Aldo, My V. T. Phan +11 · 8 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #Reinforcement Learning in Robotics
  6. The Pareto Frontier of model selection for general Contextual Bandits
    2021/10/25 by Teodor V. Marinov, Julian Zimmert, Marinov, Teodor V. +1 · 2 citations
    Decision Sciences · Computer Science · #Advanced Bandit Algorithms Research #Machine Learning and Algorithms #Reinforcement Learning in Robotics
  7. Best of Both Worlds Policy Optimization
    2023/02/18 by Christoph Dann, Dann, Christoph, Chen-Yu Wei +3 · 2 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics
  8. Refined Regret for Adversarial MDPs with Linear Function Approximation
    2023/01/30 by Yan Dai, Dai, Yan, Haipeng Luo +5 · 2 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms
  9. Connections Between Mirror Descent, Thompson Sampling and the Information Ratio
    2019/05/28 by Julian Zimmert, Zimmert, Julian, Tor Lattimore +1 · 1 citation
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Data Stream Mining Techniques #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics
  10. Optimal cross-learning for contextual bandits with unknown context distributions
    2024/01/03 by Jon Schneider, Schneider, Jon, Julian Zimmert +1 · 1 citation
    Decision Sciences · Computer Science · #Advanced Bandit Algorithms Research #Machine Learning and Algorithms #Auction Theory and Applications
  11. Towards Optimal Regret in Adversarial Linear MDPs with Bandit Feedback
    2023/10/17 by Haolin Liu, Chen-Yu Wei, Liu, Haolin +3 · 2 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics