Rudolph, Max
- Reevaluating Policy Gradient Methods for Imperfect-Information Games
2025/02/13 by Max Gustav Rudolph, Max Rudolph, Rudolph, Max +18 · 2 voices · 3 citations
Decision Sciences · #Advanced Bandit Algorithms Research #Auction Theory and Applications #Simulation Techniques and Applications #cs.LG
- Desperate Times Call for Desperate Measures: Towards Risk-Adaptive Task Allocation
2021/08/01 by Rudolph, Max, Chernova, Sonia, Ravichandar, Harish · 1 citation
#FOS: Computer and information sciences #Multiagent Systems (cs.MA) #Robotics (cs.RO)
- Rethinking Sim2Real: Lower Fidelity Simulation Leads to Higher Sim2Real Transfer in Navigation
2022/07/21 by Truong, Joanne, Rudolph, Max, Yokoyama, Naoki +3 · 1 citation
#FOS: Computer and information sciences #Robotics (cs.RO)
- RLZero: Direct Policy Inference from Language Without In-Domain Supervision
2024/12/07 by Harshit Sikchi, Siddhant Agarwal, Sikchi, Harshit +15 · 2 voices · 1 citation
Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Graphics (cs.GR) #Machine Learning (cs.LG) #Robotics (cs.RO) #cs.AI #cs.GR #cs.LG #cs.RO
- Learning Action-based Representations Using Invariance
2024/03/25 by Max Rudolph, Rudolph, Max, Caleb Chuck +9 · 1 citation
Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Data Classification #Neural Networks and Applications