vix.ing · top · new · best · stats · spec

Teodor V. Marinov

  1. Beyond Value-Function Gaps: Improved Instance-Dependent Regret Bounds\n for Episodic Reinforcement Learning
    2021/07/02 by Christoph Dann, Teodor V. Marinov, Dann, Christoph +5 · 7 citations
    Computer Science · Decision Sciences · Engineering · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics #Smart Grid Energy Management
  2. Stochastic Approximation for Canonical Correlation Analysis
    2017/02/22 by Raman Arora, Arora, Raman, Teodor V. Marinov +5 · 3 citations
    Computer Science · Mathematics · #Blind Source Separation Techniques #Bayesian Methods and Mixture Models #Random Matrices and Applications
  3. The Pareto Frontier of model selection for general Contextual Bandits
    2021/10/25 by Teodor V. Marinov, Julian Zimmert, Marinov, Teodor V. +1 · 2 citations
    Decision Sciences · Computer Science · #Advanced Bandit Algorithms Research #Machine Learning and Algorithms #Reinforcement Learning in Robotics
  4. Corralling Stochastic Bandit Algorithms
    2020/06/16 by Raman Arora, Arora, Raman, Teodor V. Marinov +3 · 3 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Auction Theory and Applications #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics
  5. Policy Regret in Repeated Games
    2018/11/09 by Raman Arora, Arora, Raman, Michael Dinitz +5 · 1 citation
    Decision Sciences · Social Sciences · #Advanced Bandit Algorithms Research #Misinformation and Its Impacts #Game Theory and Applications