Štrupl, Miroslav
- Reward-Weighted Regression Converges to a Global Optimum
2021/07/19 by Miroslav Štrupl, Štrupl, Miroslav, Francesco Faccio +7 · 1 citation
Biochemistry, Genetics and Molecular Biology · Computer Science · #68T05 #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Gene Regulatory Network Analysis #I.2.6 #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Receptor Mechanisms and Signaling #Reinforcement Learning in Robotics
- Upside-Down Reinforcement Learning Can Diverge in Stochastic Environments With Episodic Resets
2022/05/13 by Miroslav Štrupl, Francesco Faccio, Štrupl, Miroslav +7 · 1 citation
Computer Science · #68T05 #Advanced Multi-Objective Optimization Algorithms #Artificial Intelligence (cs.AI) #Evolutionary Algorithms and Applications #FOS: Computer and information sciences #I.2.6 #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics