Semih Çaycı
- Policy Mirror Ascent for Efficient and Independent Learning in Mean Field Games
2022/12/29 by Batuhan Yardim, Semih Çaycı, Yardim, Batuhan +5 · 3 citations
Decision Sciences · Computer Science · Physics and Astronomy · #Advanced Bandit Algorithms Research #Stochastic Gradient Optimization Techniques #Quantum many-body systems
- Budget-Constrained Bandits over General Cost and Reward Distributions
2020/02/29 by Semih Çaycı, Cayci, Semih, Atilla Eryılmaz +3 · 3 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Search Problems #Reinforcement Learning in Robotics
- Finite-Time Analysis of Natural Actor-Critic for POMDPs
2022/02/20 by Semih Çaycı, Niao He, Cayci, Semih +3 · 2 citations
Biochemistry, Genetics and Molecular Biology · Computer Science · Medicine · #Atrial Fibrillation Management and Outcomes #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Control (math.OC) #Receptor Mechanisms and Signaling #Reinforcement Learning in Robotics
- Provably Robust Temporal Difference Learning for Heavy-Tailed Rewards
2023/06/20 by Semih Çaycı, Cayci, Semih, Atilla Eryılmaz +1 · 2 citations
Computer Science · #Age of Information Optimization #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Control (math.OC) #Reinforcement Learning in Robotics
- Continuous-Time Multi-Armed Bandits with Controlled Restarts
2020/06/30 by Semih Çaycı, Cayci, Semih, Atilla Eryılmaz +3 · 1 citation
Biochemistry, Genetics and Molecular Biology · Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Diffusion and Search Dynamics #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Control (math.OC) #Optimization and Search Problems
- A Lyapunov-Based Methodology for Constrained Optimization with Bandit Feedback
2021/06/09 by Semih Çaycı, Cayci, Semih, Yilin Zheng +3 · 1 citation
Decision Sciences · Computer Science · #Advanced Bandit Algorithms Research #Optimization and Search Problems #Auction Theory and Applications
- Linear Convergence of Entropy-Regularized Natural Policy Gradient with Linear Function Approximation
2021/06/08 by Semih Çaycı, Cayci, Semih, Niao He +3 · 1 citation
Computer Science · Decision Sciences · #Adaptive Dynamic Programming Control #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Control (math.OC) #Reinforcement Learning in Robotics
- Convergence of Gradient Descent for Recurrent Neural Networks: A Nonasymptotic Analysis
2024/02/19 by Semih Çaycı, Cayci, Semih, Atilla Eryılmaz +1 · 2 citations
Computer Science · #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Neural Networks and Applications #Optimization and Control (math.OC)