Paavo Parmas
- Total stochastic gradient algorithms and applications in reinforcement\n learning
2019/02/05 by Paavo Parmas, Parmas, Paavo · 3 citations
Computer Science · #Reinforcement Learning in Robotics #Evolutionary Algorithms and Applications
- Near-Optimal Policy Identification in Robust Constrained Markov Decision Processes via Epigraph Form
2024/08/29 by Toshinori Kitamura, Tadashi Kozuno, Kitamura, Toshinori +15 · 4 citations
Computer Science · Mathematics · #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Markov Chains and Monte Carlo Methods #Optimization and Control (math.OC) #Reinforcement Learning in Robotics #Statistical Methods and Inference
- Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation
2026/07/16 by Ku Onoda, Paavo Parmas, Hiroki Furuta +4
#cs.LG #cs.AI #cs.CV