David Šiška
- Exponential Convergence and Stability of Howard's Policy Improvement Algorithm for Controlled Diffusions
2020/01/01 by Bekzhan Kerimkulov, David Šiška, Lukasz Szpruch · 6 citations
- Mean-Field Langevin Dynamics and Energy Landscape of Neural Networks
2019/05/19 by Kaitong Hu, Zhenjie Ren, Hu, Kaitong +5 · 4 citations
Computer Science · Mathematics · Medicine · #37M25 #60H30 #Advanced Neuroimaging Techniques and Applications #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (stat.ML) #Markov Chains and Monte Carlo Methods #Optimization and Control (math.OC) #Probability (math.PR) #Stochastic Gradient Optimization Techniques
- A Fisher-Rao gradient flow for entropy-regularised Markov decision processes in Polish spaces
2023/10/04 by Bekzhan Kerimkulov, James-Michael Leahy, Kerimkulov, Bekzhan +7 · 1 citation
Computer Science · Mathematics · #60B05 #90C26 #90C40 #90C53 #93E20 #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Markov Chains and Monte Carlo Methods #Optimization and Control (math.OC) #Probability (math.PR) #Reinforcement Learning in Robotics #Stochastic Gradient Optimization Techniques