vix.ing · top · new · best · stats · spec

Semih Çaycı

  1. Policy Mirror Ascent for Efficient and Independent Learning in Mean Field Games
    2022/12/29 by Batuhan Yardim, Semih Çaycı, Yardim, Batuhan +5 · 3 citations
    Decision Sciences · Computer Science · Physics and Astronomy · #Advanced Bandit Algorithms Research #Stochastic Gradient Optimization Techniques #Quantum many-body systems
  2. Budget-Constrained Bandits over General Cost and Reward Distributions
    2020/02/29 by Semih Çaycı, Cayci, Semih, Atilla Eryılmaz +3 · 3 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Search Problems #Reinforcement Learning in Robotics
  3. Finite-Time Analysis of Natural Actor-Critic for POMDPs
    2022/02/20 by Semih Çaycı, Niao He, Cayci, Semih +3 · 2 citations
    Biochemistry, Genetics and Molecular Biology · Computer Science · Medicine · #Atrial Fibrillation Management and Outcomes #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Control (math.OC) #Receptor Mechanisms and Signaling #Reinforcement Learning in Robotics
  4. Provably Robust Temporal Difference Learning for Heavy-Tailed Rewards
    2023/06/20 by Semih Çaycı, Cayci, Semih, Atilla Eryılmaz +1 · 2 citations
    Computer Science · #Age of Information Optimization #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Control (math.OC) #Reinforcement Learning in Robotics
  5. Continuous-Time Multi-Armed Bandits with Controlled Restarts
    2020/06/30 by Semih Çaycı, Cayci, Semih, Atilla Eryılmaz +3 · 1 citation
    Biochemistry, Genetics and Molecular Biology · Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Diffusion and Search Dynamics #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Control (math.OC) #Optimization and Search Problems
  6. A Lyapunov-Based Methodology for Constrained Optimization with Bandit Feedback
    2021/06/09 by Semih Çaycı, Cayci, Semih, Yilin Zheng +3 · 1 citation
    Decision Sciences · Computer Science · #Advanced Bandit Algorithms Research #Optimization and Search Problems #Auction Theory and Applications
  7. Linear Convergence of Entropy-Regularized Natural Policy Gradient with Linear Function Approximation
    2021/06/08 by Semih Çaycı, Cayci, Semih, Niao He +3 · 1 citation
    Computer Science · Decision Sciences · #Adaptive Dynamic Programming Control #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Control (math.OC) #Reinforcement Learning in Robotics
  8. Convergence of Gradient Descent for Recurrent Neural Networks: A Nonasymptotic Analysis
    2024/02/19 by Semih Çaycı, Cayci, Semih, Atilla Eryılmaz +1 · 2 citations
    Computer Science · #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Neural Networks and Applications #Optimization and Control (math.OC)