Teodor V. Marinov
- Beyond Value-Function Gaps: Improved Instance-Dependent Regret Bounds\n for Episodic Reinforcement Learning
2021/07/02 by Christoph Dann, Teodor V. Marinov, Dann, Christoph +5 · 7 citations
Computer Science · Decision Sciences · Engineering · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics #Smart Grid Energy Management
- Stochastic Approximation for Canonical Correlation Analysis
2017/02/22 by Raman Arora, Arora, Raman, Teodor V. Marinov +5 · 3 citations
Computer Science · Mathematics · #Blind Source Separation Techniques #Bayesian Methods and Mixture Models #Random Matrices and Applications
- The Pareto Frontier of model selection for general Contextual Bandits
2021/10/25 by Teodor V. Marinov, Julian Zimmert, Marinov, Teodor V. +1 · 2 citations
Decision Sciences · Computer Science · #Advanced Bandit Algorithms Research #Machine Learning and Algorithms #Reinforcement Learning in Robotics
- Corralling Stochastic Bandit Algorithms
2020/06/16 by Raman Arora, Arora, Raman, Teodor V. Marinov +3 · 3 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Auction Theory and Applications #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics
- Policy Regret in Repeated Games
2018/11/09 by Raman Arora, Arora, Raman, Michael Dinitz +5 · 1 citation
Decision Sciences · Social Sciences · #Advanced Bandit Algorithms Research #Misinformation and Its Impacts #Game Theory and Applications