vix.ing · top · new · best · stats · spec

Thoppe, Gugan

  1. A Concentration Bound for Stochastic Approximation via Alekseev's\n Formula
    2015/06/26 by Gugan Thoppe, Vivek S. Borkar, Thoppe, Gugan +1 · 2 citations
    Economics, Econometrics and Finance · Mathematics · Physics and Astronomy · #Advanced Thermodynamics and Statistical Mechanics #FOS: Mathematics #Mathematical Biology Tumor Growth #Optimization and Control (math.OC) #Stochastic processes and financial applications
  2. A Tale of Two-Timescale Reinforcement Learning with the Tightest Finite-Time Bound
    2019/11/20 by Gal Dalal, Dalal, Gal, Balázs Szörényi +3 · 2 citations
    Computer Science · Decision Sciences · #Adaptive Dynamic Programming Control #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Probability (math.PR) #Reinforcement Learning in Robotics
  3. Finite Sample Analysis of Two-Timescale Stochastic Approximation with Applications to Reinforcement Learning
    2017/03/15 by Gal Dalal, Dalal, Gal, Balázs Szörényi +5 · 2 citations
    Computer Science · Decision Sciences · Engineering · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #Evolutionary Algorithms and Applications #FOS: Computer and information sciences #Reinforcement Learning in Robotics #Simulation Techniques and Applications #Traffic control and management
  4. Randomly Weighted d-complexes: Minimal Spanning Acycles and Persistence Diagrams
    2017/01/01 by Skraba, Primoz, Thoppe, Gugan, Yogeshwaran, D. · 1 citation
    #05C80 (Secondary) #05E45 (Primary) 60G70 #60B99 #60C05 #FOS: Mathematics #Probability (math.PR)
  5. Does DQN Learn?
    2022/05/26 by Aditya Gopalan, Gugan Thoppe, Gopalan, Aditya +1 · 2 citations
    Computer Science · Engineering · #Reinforcement Learning in Robotics #Advancements in Semiconductor Devices and Circuit Design #Evolutionary Algorithms and Applications
  6. Change Rate Estimation and Optimal Freshness in Web Page Crawling
    2020/04/05 by Avrachenkov, Konstantin, Patil, Kishor, Thoppe, Gugan · 1 citation
    #FOS: Computer and information sciences #FOS: Mathematics #Information Retrieval (cs.IR) #Machine Learning (cs.LG) #Probability (math.PR) #Social and Information Networks (cs.SI)
  7. Finite Sample Analyses for TD(0) with Function Approximation
    2017/04/04 by Gal Dalal, Dalal, Gal, Balázs Szörényi +5 · 1 citation
    Computer Science · #Reinforcement Learning in Robotics #Evolutionary Algorithms and Applications #Advanced Multi-Objective Optimization Algorithms
  8. Online Learning of Weakly Coupled MDP Policies for Load Balancing and Auto Scaling
    2024/06/20 by Eshwar, S. R., Felipe, Lucas Lopes, Reiffers-Masson, Alexandre +2 · 1 citation
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #FOS: Electrical engineering #Networking and Internet Architecture (cs.NI) #Systems and Control (eess.SY) #electronic engineering #information engineering
  9. Global Convergence Guarantees for Federated Policy Gradient Methods with Adversaries
    2024/03/15 by Ganesh, Swetha, Chen, Jiayu, Thoppe, Gugan +1 · 1 citation
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Optimization and Control (math.OC)