Thoppe, Gugan
- A Concentration Bound for Stochastic Approximation via Alekseev's\n Formula
2015/06/26 by Gugan Thoppe, Vivek S. Borkar, Thoppe, Gugan +1 · 2 citations
Economics, Econometrics and Finance · Mathematics · Physics and Astronomy · #Advanced Thermodynamics and Statistical Mechanics #FOS: Mathematics #Mathematical Biology Tumor Growth #Optimization and Control (math.OC) #Stochastic processes and financial applications
- A Tale of Two-Timescale Reinforcement Learning with the Tightest Finite-Time Bound
2019/11/20 by Gal Dalal, Dalal, Gal, Balázs Szörényi +3 · 2 citations
Computer Science · Decision Sciences · #Adaptive Dynamic Programming Control #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Probability (math.PR) #Reinforcement Learning in Robotics
- Finite Sample Analysis of Two-Timescale Stochastic Approximation with Applications to Reinforcement Learning
2017/03/15 by Gal Dalal, Dalal, Gal, Balázs Szörényi +5 · 2 citations
Computer Science · Decision Sciences · Engineering · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #Evolutionary Algorithms and Applications #FOS: Computer and information sciences #Reinforcement Learning in Robotics #Simulation Techniques and Applications #Traffic control and management
- Randomly Weighted d-complexes: Minimal Spanning Acycles and Persistence Diagrams
2017/01/01 by Skraba, Primoz, Thoppe, Gugan, Yogeshwaran, D. · 1 citation
#05C80 (Secondary) #05E45 (Primary) 60G70 #60B99 #60C05 #FOS: Mathematics #Probability (math.PR)
- Does DQN Learn?
2022/05/26 by Aditya Gopalan, Gugan Thoppe, Gopalan, Aditya +1 · 2 citations
Computer Science · Engineering · #Reinforcement Learning in Robotics #Advancements in Semiconductor Devices and Circuit Design #Evolutionary Algorithms and Applications
- Change Rate Estimation and Optimal Freshness in Web Page Crawling
2020/04/05 by Avrachenkov, Konstantin, Patil, Kishor, Thoppe, Gugan · 1 citation
#FOS: Computer and information sciences #FOS: Mathematics #Information Retrieval (cs.IR) #Machine Learning (cs.LG) #Probability (math.PR) #Social and Information Networks (cs.SI)
- Finite Sample Analyses for TD(0) with Function Approximation
2017/04/04 by Gal Dalal, Dalal, Gal, Balázs Szörényi +5 · 1 citation
Computer Science · #Reinforcement Learning in Robotics #Evolutionary Algorithms and Applications #Advanced Multi-Objective Optimization Algorithms
- Online Learning of Weakly Coupled MDP Policies for Load Balancing and Auto Scaling
2024/06/20 by Eshwar, S. R., Felipe, Lucas Lopes, Reiffers-Masson, Alexandre +2 · 1 citation
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #FOS: Electrical engineering #Networking and Internet Architecture (cs.NI) #Systems and Control (eess.SY) #electronic engineering #information engineering
- Global Convergence Guarantees for Federated Policy Gradient Methods with Adversaries
2024/03/15 by Ganesh, Swetha, Chen, Jiayu, Thoppe, Gugan +1 · 1 citation
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Optimization and Control (math.OC)