vix.ing · top · new · best · stats · spec

Martin Riedmiller

  1. Playing Atari with Deep Reinforcement Learning
    2013/12/19 by Volodymyr Mnih, Mnih, Volodymyr, Koray Kavukcuoglu +11 · 5 voices · 533 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Artificial Intelligence in Games #Reinforcement Learning in Robotics #cs.LG
  2. DeepMind Control Suite
    2018/01/02 by Yuval Tassa, Yotam Doron, Tassa, Yuval +21 · 2 voices · 164 citations
    Computer Science · #Distributed and Parallel Computing Systems #Parallel Computing and Optimization Techniques #Reinforcement Learning in Robotics #cs.AI
  3. Graph networks as learnable physics engines for inference and control
    2018/06/04 by Álvaro Sánchez‐González, Nicolas Heess, Sanchez-Gonzalez, Alvaro +11 · 44 citations
    Computer Science · #Anomaly Detection Techniques and Applications #Artificial Intelligence (cs.AI) #Data Visualization and Analytics #Explainable Artificial Intelligence (XAI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
  4. Magnetic control of tokamak plasmas through deep reinforcement learning
    2022/02/16 by Jonas Degrave, F. Felici, Jonas Buchli +28 · 40 citations
    Physics and Astronomy · #Magnetic confinement fusion research
  5. Embed to Control: A Locally Linear Latent Dynamics Model for Control from Raw Images
    2015/06/24 by Manuel Watter, Jost Tobias Springenberg, Watter, Manuel +5 · 23 citations
    Computer Science · Physics and Astronomy · #Generative Adversarial Networks and Image Synthesis #Neural Networks and Applications #Model Reduction and Neural Networks
  6. RoboCat: A Self-Improving Generalist Agent for Robotic Manipulation
    2023/06/20 by Konstantinos Bousmalis, Giulia Vezzani, Bousmalis, Konstantinos +73 · 40 citations
    Computer Science · #Multimodal Machine Learning Applications #Domain Adaptation and Few-Shot Learning #Reinforcement Learning in Robotics
  7. Emergence of Locomotion Behaviours in Rich Environments
    2017/07/07 by Nicolas Heess, Dhruva Tb, Heess, Nicolas +21 · 23 citations
    Biochemistry, Genetics and Molecular Biology · Computer Science · Engineering · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Reinforcement Learning in Robotics #Robotic Locomotion and Control #Zebrafish Biomedical Research Applications
  8. TORAX: A Fast and Differentiable Tokamak Transport Simulator in JAX
    2024/06/10 by Jonathan Citrin, J. Citrin, Ian Goodfellow +29 · 2 voices · 5 citations
    Physics and Astronomy · Engineering · #physics.plasm-ph
  9. Discriminative Unsupervised Feature Learning with Exemplar Convolutional\n Neural Networks
    2014/06/26 by Alexey Dosovitskiy, Philipp Fischer, Dosovitskiy, Alexey +7 · 5 citations
    Computer Science · #Advanced Image and Video Retrieval Techniques #Advanced Neural Network Applications #Computer Vision and Pattern Recognition (cs.CV) #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Neural and Evolutionary Computing (cs.NE)
  10. Improving Deep Neural Networks with Probabilistic Maxout Units
    2013/12/20 by Jost Tobias Springenberg, Springenberg, Jost Tobias, Martin Riedmiller +1 · 8 citations
    Computer Science · #Advanced Neural Network Applications #Adversarial Robustness in Machine Learning #Domain Adaptation and Few-Shot Learning
  11. V-MPO: On-Policy Maximum a Posteriori Policy Optimization for Discrete and Continuous Control
    2019/09/26 by Hao Song, Abbas Abdolmaleki, Song, H. Francis +25 · 9 citations
    Biochemistry, Genetics and Molecular Biology · Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics #Single-cell and spatial transcriptomics #Zebrafish Biomedical Research Applications
  12. Relative Entropy Regularized Policy Iteration
    2018/12/05 by Abbas Abdolmaleki, Abdolmaleki, Abbas, Jost Tobias Springenberg +13 · 6 citations
    Computer Science · Engineering · #Adaptive Dynamic Programming Control #Advanced Control Systems Optimization #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics
  13. Offline Actor-Critic Reinforcement Learning Scales to Large Models
    2024/02/08 by Jost Tobias Springenberg, Springenberg, Jost Tobias, Abbas Abdolmaleki +21 · 8 citations
    Psychology · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Mental Health Research Topics #Robotics (cs.RO)
  14. Continuous-Discrete Reinforcement Learning for Hybrid Control in\n Robotics
    2020/01/02 by Michael Neunert, Neunert, Michael, Abbas Abdolmaleki +17 · 3 citations
    Biochemistry, Genetics and Molecular Biology · Computer Science · #FOS: Computer and information sciences #Formal Methods in Verification #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Robotics (cs.RO) #Viral Infectious Diseases and Gene Expression in Insects
  15. A Distributional View on Multi-Objective Policy Optimization
    2020/05/15 by Abbas Abdolmaleki, Sandy H. Huang, Abdolmaleki, Abbas +16 · 3 citations
    Computer Science · #Advanced Multi-Objective Optimization Algorithms #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Robotics (cs.RO)
  16. Robust Constrained Reinforcement Learning for Continuous Control with Model Misspecification
    2020/10/20 by Daniel J. Mankowitz, Mankowitz, Daniel J., Dan A. Calian +13 · 3 citations
    Computer Science · Engineering · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Real-Time Systems Scheduling #Reinforcement Learning in Robotics #Smart Grid Energy Management
  17. Learning Robot Soccer from Egocentric Vision with Deep Reinforcement Learning
    2024/05/03 by Dhruva Tirumala, Markus Wulfmeier, Tirumala, Dhruva +29 · 6 citations
    Computer Science · #Anomaly Detection Techniques and Applications #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Human Pose and Action Recognition #Reinforcement Learning in Robotics #Robotics (cs.RO)
  18. Mastering Stacking of Diverse Shapes with Large-Scale Iterative Reinforcement Learning on Real Robots
    2023/12/18 by Thomas Lampe, Abbas Abdolmaleki, Lampe, Thomas +27 · 5 citations
    Computer Science · Engineering · #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Reinforcement Learning in Robotics #Robot Manipulation and Learning #Robotics (cs.RO)
  19. Robust Reinforcement Learning for Continuous Control with Model Misspecification
    2019/06/18 by Daniel J. Mankowitz, Mankowitz, Daniel J., Nir Levine +17 · 2 citations
    Computer Science · #Adaptive Dynamic Programming Control #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics
  20. Collect & Infer -- a fresh look at data-efficient Reinforcement Learning
    2021/08/23 by Martin Riedmiller, Jost Tobias Springenberg, Riedmiller, Martin +5 · 3 citations
    Computer Science · #Adversarial Robustness in Machine Learning #Data Stream Mining Techniques #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
  21. On Multi-objective Policy Optimization as a Tool for Reinforcement Learning: Case Studies in Offline RL and Finetuning
    2021/06/15 by Abbas Abdolmaleki, Sandy H. Huang, Abdolmaleki, Abbas +25 · 2 citations
    Computer Science · #Advanced Multi-Objective Optimization Algorithms #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics #Robotics (cs.RO)
  22. Learning from negative feedback, or positive feedback or both
    2024/10/05 by Abbas Abdolmaleki, Abdolmaleki, Abbas, Bilal Piot +21 · 5 citations
    Computer Science · #Semantic Web and Ontologies
  23. Imitating Language via Scalable Inverse Reinforcement Learning
    2024/09/02 by Markus Wulfmeier, Wulfmeier, Markus, Michael Bloesch +29 · 3 citations
    Computer Science · Engineering · #Reinforcement Learning in Robotics #Evolutionary Algorithms and Applications #Modular Robots and Swarm Intelligence
  24. A Generalist Dynamics Model for Control
    2023/05/18 by Ingmar Schubert, Schubert, Ingmar, Jingwei Zhang +17 · 2 citations
    Computer Science · Physics and Astronomy · #Neural Networks and Applications #Neural Networks and Reservoir Computing #Model Reduction and Neural Networks
  25. Replay across Experiments: A Natural Extension of Off-Policy RL
    2023/11/27 by Dhruva Tirumala, Tirumala, Dhruva, Thomas Lampe +21 · 2 citations
    Computer Science · Engineering · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics #Robotic Locomotion and Control #Robotics (cs.RO)
  26. DemoStart: Demonstration-led auto-curriculum applied to sim-to-real with multi-fingered robots
    2024/09/10 by Maria Bauzá, José Enrique Chen, Bauza, Maria +29 · 2 citations
    Computer Science · Engineering · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Robot Manipulation and Learning #Robotic Mechanisms and Dynamics #Robotics (cs.RO) #Teaching and Learning Programming