Shimon Whiteson
- Learning to Communicate to Solve Riddles with Deep Distributed Recurrent\n Q-Networks
2016/02/08 by Jakob N. Foerster, Jakob Foerster, Foerster, Jakob N. +7 · 3 voices · 11 citations
Computer Science · Engineering · #Architecture #Artificial intelligence #Communications protocol #Computer network #Computer science #Deep learning #Distributed Control Multi-Agent Systems #Distributed computing #Human–computer interaction #Modular Robots and Swarm Intelligence #Order (exchange) #Protocol (science) #Q-learning #Reinforcement Learning in Robotics #Reinforcement learning #Telecommunications network #cs.AI #cs.LG
- The StarCraft Multi-Agent Challenge
2019/02/11 by Mikayel Samvelyan, Samvelyan, Mikayel, Tabish Rashid +17 · 1 voice · 91 citations
Computer Science · Mathematics · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Multiagent Systems (cs.MA) #cs.LG #cs.MA #stat.ML
- Counterfactual Multi-Agent Policy Gradients
2017/05/24 by Jakob Foerster, Foerster, Jakob, Gregory Farquhar +7 · 1 voice · 183 citations
Computer Science · Engineering · #Fuel Cells and Related Materials #Reinforcement Learning in Robotics #cs.AI #cs.MA
- Learning to Communicate with Deep Multi-Agent Reinforcement Learning
2016/05/21 by Jakob N. Foerster, Jakob Foerster, Yannis Assael +7 · 149 citations
Computer Science · #Adversarial Robustness in Machine Learning #Machine Learning and Algorithms #Reinforcement Learning in Robotics #cs.AI #cs.LG #cs.MA
- QMIX: Monotonic Value Function Factorisation for Deep Multi-Agent Reinforcement Learning
2018/03/30 by Tabish Rashid, Mikayel Samvelyan, Rashid, Tabish +9 · 77 citations
Computer Science · Decision Sciences · Mathematics · #Auction Theory and Applications #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Mobile Crowdsensing and Crowdsourcing #Multiagent Systems (cs.MA) #Open Source Software Innovations #Reinforcement Learning in Robotics #cs.LG #cs.MA #stat.ML
- VariBAD: A Very Good Method for Bayes-Adaptive Deep RL via Meta-Learning
2019/10/18 by Luisa Zintgraf, Zintgraf, Luisa, Kyriacos Shiarlis +11 · 1 voice · 26 citations
Computer Science · Mathematics · #Domain Adaptation and Few-Shot Learning #Gaussian Processes and Bayesian Inference #Machine Learning and Data Classification #cs.LG #stat.ML
- Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?
2020/11/18 by Christian Schroeder de Witt, de Witt, Christian Schroeder, Tarun Gupta +11 · 83 citations
Computer Science · #Artificial Intelligence (cs.AI) #Artificial Intelligence in Games #FOS: Computer and information sciences #Multi-Agent Systems and Negotiation #Reinforcement Learning in Robotics
- Learning with Opponent-Learning Awareness
2017/09/13 by Jakob N. Foerster, Richard Y. Chen, Foerster, Jakob N. +9 · 1 voice · 27 citations
Computer Science · #Artificial Intelligence (cs.AI) #Computer Science and Game Theory (cs.GT) #FOS: Computer and information sciences #cs.AI #cs.GT
- FACMAC: Factored Multi-Agent Centralised Policy Gradients
2020/03/14 by Bei Peng, Peng, Bei, Tabish Rashid +11 · 42 citations
Computer Science · Medicine · #Reinforcement Learning in Robotics #Adaptive Dynamic Programming Control #Mosquito-borne diseases and control
- Stabilising Experience Replay for Deep Multi-Agent Reinforcement Learning
2017/02/28 by Jakob Foerster, Foerster, Jakob, Nantas Nardelli +11 · 38 citations
Computer Science · Engineering · #Reinforcement Learning in Robotics #Smart Grid Energy Management #Smart Grid Security and Resilience #cs.AI #cs.LG #cs.MA
- Weighted QMIX: Expanding Monotonic Value Function Factorisation for Deep Multi-Agent Reinforcement Learning
2020/01/01 by Tabish Rashid, Rashid, Tabish, Gregory Farquhar +6 · 31 citations
Computer Science · Engineering · #Advanced Memory and Neural Computing #Adversarial Robustness in Machine Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics
- A Tutorial on Meta-Reinforcement Learning
2023/01/19 by Jacob Beck, Risto Vuorio, Beck, Jacob +11 · 1 voice · 18 citations
Computer Science · #Data Stream Mining Techniques #FOS: Computer and information sciences #Machine Learning (cs.LG) #Mobile Crowdsensing and Crowdsourcing #Reinforcement Learning in Robotics #cs.LG
- SMACv2: An Improved Benchmark for Cooperative Multi-Agent Reinforcement Learning
2022/12/14 by Benjamin J. Ellis, Ellis, Benjamin, Skander Moalla +12 · 32 citations
Computer Science · #Reinforcement Learning in Robotics #Machine Learning and Data Classification #Adaptive Dynamic Programming Control
- RODE: Learning Roles to Decompose Multi-Agent Tasks
2020/10/04 by Tonghan Wang, Tarun Gupta, Wang, Tonghan +9 · 25 citations
Computer Science · #Reinforcement Learning in Robotics #Multimodal Machine Learning Applications #Artificial Intelligence in Games
- JaxMARL: Multi-Agent RL Environments and Algorithms in JAX
2023/11/16 by Alexander R. Rutherford, Benjamin J. Ellis, Rutherford, Alexander +38 · 39 citations
Computer Science · Social Sciences · #Reinforcement Learning in Robotics #Artificial Intelligence in Games #Digital Games and Media
- Imitation Is Not Enough: Robustifying Imitation with Reinforcement Learning for Challenging Driving Scenarios
2022/12/21 by Yiren Lu, Justin Fu, Lu, Yiren +21 · 28 citations
Energy · Engineering · #Artificial Intelligence (cs.AI) #Autonomous Vehicle Technology and Safety #Energy, Environment, and Transportation Policies #FOS: Computer and information sciences #I.2.6 #I.2.9 #Robotics (cs.RO) #Traffic and Road Safety
- Deep Variational Reinforcement Learning for POMDPs
2018/06/06 by Maximilian Igl, Luisa Zintgraf, Igl, Maximilian +8 · 17 citations
Computer Science · Mathematics · #Adversarial Robustness in Machine Learning #Data Stream Mining Techniques #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #cs.LG #stat.ML
- A Survey of Reinforcement Learning Informed by Natural Language
2019/06/10 by Jelena Luketina, Luketina, Jelena, Nantas Nardelli +13 · 16 citations
Computer Science · Mathematics · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #cs.AI #cs.CL #cs.LG #stat.ML
- Relative Upper Confidence Bound for the K-Armed Dueling Bandit Problem
2013/12/12 by Masrour Zoghi, Zoghi, Masrour, Shimon Whiteson +6 · 16 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Auction Theory and Applications #FOS: Computer and information sciences #Machine Learning (cs.LG) #Optimization and Search Problems #cs.LG
- Fast Context Adaptation via Meta-Learning
2018/10/08 by Luisa M Zintgraf, Luisa Zintgraf, Kyriacos Shiarlis +8 · 25 citations
Computer Science · Mathematics · #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Data Classification #Machine Learning in Healthcare #cs.LG #stat.ML
- Evolution Strategies at the Hyperscale
2025/11/20 by Bidipta Sarkar, Mattie Fellows, Sarkar, Bidipta +38 · 4 voices · 1 citation
Computer Science · Mathematics · #Metaheuristic Optimization Algorithms Research #Stochastic Gradient Optimization Techniques #Tensor decomposition and applications #cs.AI #cs.LG
- Multi-Objective Deep Reinforcement Learning
2016/10/09 by Hossam Mossalam, Yannis Assael, Yannis M. Assael +6 · 10 citations
Computer Science · #Adaptive Dynamic Programming Control #Advanced Multi-Objective Optimization Algorithms #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Reinforcement Learning in Robotics #cs.AI
- Transient Non-Stationarity and Generalisation in Deep Reinforcement Learning
2020/06/10 by Igl, Maximilian, Farquhar, Gregory, Luketina, Jelena +7 · 12 citations
Computer Science · Physics and Astronomy · #Artificial Intelligence (cs.AI) #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Model Reduction and Neural Networks #Reinforcement Learning in Robotics
- TreeQN and ATreeC: Differentiable Tree-Structured Models for Deep Reinforcement Learning
2017/10/31 by Gregory Farquhar, Farquhar, Gregory, Tim Rocktäschel +5 · 1 voice · 7 citations
Computer Science · Mathematics · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Neural and Evolutionary Computing (cs.NE) #Reinforcement Learning in Robotics #cs.AI #cs.LG #cs.NE #stat.ML
- Bayesian Action Decoder for Deep Multi-Agent Reinforcement Learning
2018/11/04 by Jakob N. Foerster, Jakob Foerster, Francis Song +14 · 12 citations
Computer Science · Engineering · #Anomaly Detection Techniques and Applications #Artificial Immune Systems Applications #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics #cs.AI #cs.LG #cs.MA
- Deep Coordination Graphs
2019/09/27 by Wendelin Böhmer, Böhmer, Wendelin, Vitaly Kurin +3 · 10 citations
Computer Science · #Advanced Graph Neural Networks #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Graph Theory and Algorithms #Machine Learning (cs.LG) #Multiagent Systems (cs.MA) #Optimization and Search Problems #cs.AI #cs.LG #cs.MA
- LipNet: End-to-End Sentence-level Lipreading
2016/11/05 by Yannis M. Assael, Yannis Assael, Assael, Yannis M. +6 · 8 citations
Computer Science · #Computation and Language (cs.CL) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Music and Audio Processing #Speech Recognition and Synthesis #Speech and Audio Processing #cs.CL #cs.CV #cs.LG
- In Defense of the Unitary Scalarization for Deep Multi-Task Learning
2022/01/11 by Vitaly Kurin, Kurin, Vitaly, Alessandro De Palma +7 · 11 citations
Computer Science · Decision Sciences · Engineering · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Sparse and Compressive Sensing Techniques #Stochastic Gradient Optimization Techniques
- A Survey of In-Context Reinforcement Learning
2025/02/11 by Amir Moeini, Jiuqi Wang, Moeini, Amir +11 · 1 voice · 14 citations
Computer Science · Engineering · Neuroscience · #EEG and Brain-Computer Interfaces #FOS: Computer and information sciences #Machine Learning (cs.LG) #Smart Grid Energy Management #cs.LG
- UniGen: Unified Modeling of Initial Agent States and Trajectories for Generating Autonomous Driving Scenarios
2024/05/06 by Reza Mahjourian, Rongbing Mu, Mahjourian, Reza +12 · 2 voices · 3 citations
Computer Science · Engineering · #Transportation and Mobility Innovations #cs.LG #cs.RO
- TACO: Learning Task Decomposition via Temporal Alignment for Control
2018/03/02 by Kyriacos Shiarlis, Shiarlis, Kyriacos, Markus Wulfmeier +7 · 9 citations
Computer Science · Engineering · Mathematics · #AI-based Problem Solving and Planning #Reinforcement Learning in Robotics #Robot Manipulation and Learning #cs.LG #stat.ML
- Hypernetworks in Meta-Reinforcement Learning
2022/10/20 by Jacob Beck, Beck, Jacob, Matthew Thomas Jackson +5 · 10 citations
Computer Science · #Artificial Intelligence (cs.AI) #Evolutionary Algorithms and Applications #FOS: Computer and information sciences #Machine Learning (cs.LG) #Mobile Crowdsensing and Crowdsourcing #Reinforcement Learning in Robotics #Robotics (cs.RO)
- Symphony: Learning Realistic and Diverse Agents for Autonomous Driving Simulation
2022/05/06 by Maximilian Igl, Igl, Maximilian, Dae Woo Kim +17 · 9 citations
Engineering · #Autonomous Vehicle Technology and Safety #FOS: Computer and information sciences #Machine Learning (cs.LG) #Robotics (cs.RO)
- Growing Action Spaces
2019/06/28 by Gregory Farquhar, Farquhar, Gregory, Laura Gustafson +9 · 6 citations
Computer Science · Mathematics · Social Sciences · #Artificial Intelligence (cs.AI) #Artificial Intelligence in Games #Digital Games and Media #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #cs.AI #cs.LG #stat.ML
- Universal Morphology Control via Contextual Modulation
2023/02/22 by Zheng Xiong, Xiong, Zheng, Jacob Beck +3 · 9 citations
Computer Science · Engineering · #Advanced Graph Neural Networks #Advanced Memory and Neural Computing #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Robotics (cs.RO)
- Multi-Agent Common Knowledge Reinforcement Learning
2018/10/27 by Christian A. Schroeder de Witt, de Witt, Christian A. Schroeder, Jakob N. Foerster +10 · 7 citations
Computer Science · Social Sciences · #Evolutionary Game Theory and Cooperation #Experimental Behavioral Economics Studies #Reinforcement Learning in Robotics #cs.AI #cs.GT #cs.LG #cs.MA
- Breaking the Deadly Triad with a Target Network
2021/01/21 by Shangtong Zhang, Hengshuai Yao, Zhang, Shangtong +3 · 7 citations
Computer Science · Decision Sciences · #Adaptive Dynamic Programming Control #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
- UneVEn: Universal Value Exploration for Multi-Agent Reinforcement\n Learning
2020/10/06 by Tarun Gupta, Anuj Mahajan, Gupta, Tarun +7 · 6 citations
Computer Science · #Artificial Intelligence (cs.AI) #Data Stream Mining Techniques #Explainable Artificial Intelligence (XAI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics
- Stable Opponent Shaping in Differentiable Games
2018/11/20 by Alistair Letcher, Letcher, Alistair, Jakob Foerster +7 · 6 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Game Theory and Applications #Machine Learning (cs.LG) #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics
- DAC: The Double Actor-Critic Architecture for Learning Options
2019/04/29 by Shangtong Zhang, Zhang, Shangtong, Shimon Whiteson +1 · 5 citations
Computer Science · Mathematics · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #cs.AI #cs.LG #stat.ML
- Copeland Dueling Bandits
2015/06/01 by Masrour Zoghi, Zoghi, Masrour, Zohar Karnin +5 · 4 citations
Business, Management and Accounting · Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Auction Theory and Applications #Consumer Market Behavior and Pricing #FOS: Computer and information sciences #Machine Learning (cs.LG) #cs.LG
- Policy-Guided Diffusion
2024/04/09 by Matthew Thomas Jackson, Jackson, Matthew Thomas, Michael Matthews +9 · 10 citations
Computer Science · #Reinforcement Learning in Robotics #Domain Adaptation and Few-Shot Learning #Generative Adversarial Networks and Image Synthesis
- Optimistic Exploration even with a Pessimistic Initialisation
2020/02/26 by Tabish Rashid, Rashid, Tabish, Bei Peng +5 · 5 citations
Computer Science · Decision Sciences · Mathematics · Neuroscience · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Neural dynamics and brain function #Reinforcement Learning in Robotics #cs.AI #cs.LG #stat.ML
- Randomized Entity-wise Factorization for Multi-Agent Reinforcement Learning
2020/06/07 by Shariq Iqbal, Christian A. Schroeder de Witt, Iqbal, Shariq +9 · 5 citations
Computer Science · #Reinforcement Learning in Robotics #Data Stream Mining Techniques #Artificial Intelligence in Games
- Equivariant Networks for Zero-Shot Coordination
2022/10/21 by Darius Muglich, Muglich, Darius, Christian Schroeder de Witt +7 · 6 citations
Computer Science · #Explainable Artificial Intelligence (XAI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics #Topic Modeling
- Mean-Variance Policy Iteration for Risk-Averse Reinforcement Learning
2020/04/22 by Shangtong Zhang, Bo Liu, Zhang, Shangtong +3 · 4 citations
Computer Science · Medicine · #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Neurological disorders and treatments #Reinforcement Learning in Robotics
- Tesseract: Tensorised Actors for Multi-Agent Reinforcement Learning
2021/05/31 by Anuj Mahajan, Mahajan, Anuj, Mikayel Samvelyan +15 · 5 citations
Engineering · Mathematics · Physics and Astronomy · #FOS: Computer and information sciences #Lattice Boltzmann Simulation Studies #Machine Learning (cs.LG) #Model Reduction and Neural Networks #Tensor decomposition and applications
- DiCE: The Infinitely Differentiable Monte-Carlo Estimator
2018/02/14 by Jakob Foerster, Foerster, Jakob, Gregory Farquhar +9 · 3 citations
Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Neural and Evolutionary Computing (cs.NE) #cs.AI #cs.LG #cs.NE
- VIREL: A Variational Inference Framework for Reinforcement Learning
2018/11/03 by Matthew Fellows, Anuj Mahajan, Fellows, Matthew +5 · 4 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Adversarial Robustness in Machine Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics
- Average-Reward Off-Policy Policy Evaluation with Function Approximation
2021/01/08 by Shangtong Zhang, Zhang, Shangtong, Yi Wan +5 · 6 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Optimization and Search Problems #Reinforcement Learning in Robotics
- Exploration with Unreliable Intrinsic Reward in Multi-Agent Reinforcement Learning
2019/06/05 by Wendelin Böhmer, Böhmer, Wendelin, Tabish Rashid +3 · 6 citations
Computer Science · Neuroscience · #Adaptive Dynamic Programming Control #Neural and Behavioral Psychology Studies #Reinforcement Learning in Robotics #cs.AI
- Regularized Softmax Deep Multi-Agent Q-Learning
2021/03/22 by Ling Pan, Tabish Rashid, Pan, Ling +7 · 3 citations
Computer Science · #Distributed Control Multi-Agent Systems #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and ELM #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics
- Provably Convergent Two-Timescale Off-Policy Actor-Critic with Function Approximation
2019/11/11 by Shangtong Zhang, Zhang, Shangtong, Bo Liu +5 · 9 citations
Computer Science · Physics and Astronomy · #Adaptive Dynamic Programming Control #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Model Reduction and Neural Networks #Reinforcement Learning in Robotics
- Stochastic Optimization for Collision Selection in High Energy Physics
2006/07/10 by Shimon Whiteson, S. Whiteson, Whiteson, S. +2 · 2 citations
Computer Science · Decision Sciences · Physics and Astronomy · #Algorithms and Data Compression #FOS: Physical sciences #High Energy Physics - Experiment (hep-ex) #Machine Learning and Algorithms #Simulation Techniques and Applications #hep-ex
- Privileged Information Dropout in Reinforcement Learning
2020/05/19 by Pierre-Alexandre Kamienny, Kai Arulkumaran, Kamienny, Pierre-Alexandre +7 · 2 citations
Computer Science · Mathematics · #Artificial Intelligence (cs.AI) #Data Stream Mining Techniques #Evolutionary Algorithms and Applications #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #cs.AI #cs.LG #stat.ML
- WordCraft: An Environment for Benchmarking Commonsense Agents
2020/07/17 by Minqi Jiang, Jiang, Minqi, Jelena Luketina +11 · 2 citations
Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Natural Language Processing Techniques #Reinforcement Learning in Robotics #Topic Modeling
- Distilling Morphology-Conditioned Hypernetworks for Efficient Universal Morphology Control
2024/02/09 by Xiong Zheng, Risto Vuorio, Xiong, Zheng +9 · 4 citations
Engineering · #Modular Robots and Swarm Intelligence
- Exploration in Approximate Hyper-State Space for Meta Reinforcement\n Learning
2020/10/02 by Luisa Zintgraf, Leo Feng, Zintgraf, Luisa +12 · 2 citations
Computer Science · #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #Data Stream Mining Techniques #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Data Classification #Reinforcement Learning in Robotics
- Communicating via Markov Decision Processes
2021/07/17 by Samuel Sokota, Sokota, Samuel, Christian Schroeder de Witt +15 · 2 citations
Computer Science · Engineering · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics #Wireless Communication Security Techniques
- Deep Residual Reinforcement Learning
2019/05/03 by Shangtong Zhang, Zhang, Shangtong, Wendelin Boehmer +3 · 2 citations
Computer Science · Engineering · Mathematics · #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Robot Manipulation and Learning #cs.AI #cs.LG #stat.ML
- You May Not Need Ratio Clipping in PPO
2022/01/31 by Mingfei Sun, Sun, Mingfei, Vitaly Kurin +11 · 2 citations
Computer Science · #Machine Learning and Algorithms #Advanced Multi-Objective Optimization Algorithms #Machine Learning and Data Classification
- A Survey of Multi-Objective Sequential Decision-Making
2014/02/04 by Diederik Marijn Roijers, Peter Vamplew, Shimon Whiteson +1 · 1 citation
Computer Science · #cs.AI
- Truncated Emphatic Temporal Difference Methods for Prediction and Control
2021/08/11 by Shangtong Zhang, Shimon Whiteson, Zhang, Shangtong +1 · 4 citations
Computer Science · Engineering · #FOS: Computer and information sciences #Fuel Cells and Related Materials #Machine Learning (cs.LG) #Real-time simulation and control systems #Reinforcement Learning in Robotics
- Learning to Drive in New Cities Without Human Demonstrations
2026/02/09 by Zilin Wang, Saeed Rahmani, Daphne Cornelisse +4 · 2 voices · 3 citations
Computer Science · #cs.RO #cs.LG #cs.MA
- Recurrent Hypernetworks are Surprisingly Strong in Meta-RL
2023/09/26 by Jacob Beck, Beck, Jacob, Risto Vuorio +5 · 1 voice · 2 citations
Computer Science · #Artificial Intelligence (cs.AI) #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and Data Classification #Reinforcement Learning in Robotics #Robotics (cs.RO) #cs.AI #cs.LG #cs.RO
- Expected Policy Gradients
2017/06/15 by Kamil Ciosek, Shimon Whiteson, Ciosek, Kamil +1 · 2 citations
Computer Science · Mathematics · #90C40 #FOS: Computer and information sciences #G.3 #I.2.8 #Machine Learning (cs.LG) #Machine Learning (stat.ML) #acm:90C40 #cs.LG #msc:90C40 #stat.ML
- Learning from Demonstration in the Wild
2018/11/08 by Feryal Behbahani, Kyriacos Shiarlis, Behbahani, Feryal +19 · 1 citation
Computer Science · Mathematics · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #cs.LG #stat.ML
- Adam on Local Time: Addressing Nonstationarity in RL with Relative Adam Timesteps
2024/12/22 by Benjamin J. Ellis, Ellis, Benjamin, Matthew Jackson +11 · 5 citations
Computer Science · #Multi-Agent Systems and Negotiation #Logic, Reasoning, and Knowledge
- Loaded DiCE: Trading off Bias and Variance in Any-Order Score Function Estimators for Reinforcement Learning
2019/09/23 by Gregory Farquhar, Shimon Whiteson, Farquhar, Gregory +3 · 1 citation
Computer Science · Mathematics · Psychology · #Advanced Multi-Objective Optimization Algorithms #Data Stream Mining Techniques #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Mental Health Research Topics #Reinforcement Learning in Robotics #cs.LG #stat.ML
- Multitask Soft Option Learning
2019/04/01 by Maximilian Igl, Andrew Gambardella, Igl, Maximilian +11 · 1 citation
Computer Science · Economics, Econometrics and Finance · Engineering · Mathematics · #Capital Investment and Risk Analysis #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Reservoir Engineering and Simulation Methods #cs.LG #stat.ML
- A Clean Slate for Offline Reinforcement Learning
2025/04/15 by Matthew Thomas Jackson, Jackson, Matthew Thomas, Uljad Berdica +8 · 1 voice · 3 citations
Computer Science · #Machine Learning and Data Classification #Reinforcement Learning in Robotics #Stochastic Gradient Optimization Techniques #cs.AI #cs.LG #cs.RO
- Discovering General Reinforcement Learning Algorithms with Adversarial Environment Design
2023/10/04 by Matthew Thomas Jackson, Jackson, Matthew Thomas, Minqi Jiang +13 · 2 citations
Decision Sciences · Computer Science · #Advanced Bandit Algorithms Research #Machine Learning and Data Classification #Reinforcement Learning in Robotics
- Deterministic and Discriminative Imitation (D2-Imitation): Revisiting Adversarial Imitation for Sample Efficiency
2021/12/11 by Mingfei Sun, Sun, Mingfei, Sam Devlin +5 · 1 citation
Computer Science · Engineering · #Adversarial Robustness in Machine Learning #Reinforcement Learning in Robotics #Robot Manipulation and Learning
- On the Practical Consistency of Meta-Reinforcement Learning Algorithms
2021/12/01 by Zheng Xiong, Xiong, Zheng, Luisa Zintgraf +7 · 1 citation
Computer Science · #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Data Classification #Reinforcement Learning in Robotics
- Fourier Policy Gradients
2018/02/19 by Matthew Fellows, Kamil Ciosek, Fellows, Matthew +3 · 1 voice
Computer Science · Engineering · #Adaptive Dynamic Programming Control #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Fuel Cells and Related Materials #Machine Learning (cs.LG) #Reinforcement Learning in Robotics #cs.AI #cs.LG
- Hierarchical Imitation Learning for Stochastic Environments
2023/09/25 by Maximilian Igl, Igl, Maximilian, Punit Shah +13 · 1 citation
Engineering · Computer Science · #Autonomous Vehicle Technology and Safety #Human Pose and Action Recognition #Explainable Artificial Intelligence (XAI)
- Trust Region Bounds for Decentralized PPO Under Non-stationarity
2022/01/31 by Mingfei Sun, Sun, Mingfei, Sam Devlin +6 · 2 citations
Computer Science · Decision Sciences · #Adaptive Dynamic Programming Control #Auction Theory and Applications #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
- Generalized Off-Policy Actor-Critic
2019/03/27 by Shangtong Zhang, Zhang, Shangtong, Wendelin Boehmer +3 · 1 citation
Computer Science · Mathematics · #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Software Testing and Debugging Techniques #cs.AI #cs.LG #stat.ML
- A Bayesian Solution To The Imitation Gap
2024/06/29 by Risto Vuorio, Vuorio, Risto, Mattie Fellows +7 · 1 citation
Computer Science · Decision Sciences · Engineering · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics #Robot Manipulation and Learning
- HyperVLA: Efficient Inference in Vision-Language-Action Models via Hypernetworks
2025/10/06 by Zheng Xiong, Kang Li, Xiong, Zheng +9 · 3 citations
Computer Science · #Artificial Intelligence (cs.AI) #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multimodal Machine Learning Applications #Reinforcement Learning in Robotics #Robotics (cs.RO)