vix.ing · top · new · best · stats · spec

Shimon Whiteson

  1. Learning to Communicate to Solve Riddles with Deep Distributed Recurrent\n Q-Networks
    2016/02/08 by Jakob N. Foerster, Jakob Foerster, Foerster, Jakob N. +7 · 3 voices · 11 citations
    Computer Science · Engineering · #Architecture #Artificial intelligence #Communications protocol #Computer network #Computer science #Deep learning #Distributed Control Multi-Agent Systems #Distributed computing #Human–computer interaction #Modular Robots and Swarm Intelligence #Order (exchange) #Protocol (science) #Q-learning #Reinforcement Learning in Robotics #Reinforcement learning #Telecommunications network #cs.AI #cs.LG
  2. The StarCraft Multi-Agent Challenge
    2019/02/11 by Mikayel Samvelyan, Samvelyan, Mikayel, Tabish Rashid +17 · 1 voice · 91 citations
    Computer Science · Mathematics · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Multiagent Systems (cs.MA) #cs.LG #cs.MA #stat.ML
  3. Counterfactual Multi-Agent Policy Gradients
    2017/05/24 by Jakob Foerster, Foerster, Jakob, Gregory Farquhar +7 · 1 voice · 183 citations
    Computer Science · Engineering · #Fuel Cells and Related Materials #Reinforcement Learning in Robotics #cs.AI #cs.MA
  4. Learning to Communicate with Deep Multi-Agent Reinforcement Learning
    2016/05/21 by Jakob N. Foerster, Jakob Foerster, Yannis Assael +7 · 149 citations
    Computer Science · #Adversarial Robustness in Machine Learning #Machine Learning and Algorithms #Reinforcement Learning in Robotics #cs.AI #cs.LG #cs.MA
  5. QMIX: Monotonic Value Function Factorisation for Deep Multi-Agent Reinforcement Learning
    2018/03/30 by Tabish Rashid, Mikayel Samvelyan, Rashid, Tabish +9 · 77 citations
    Computer Science · Decision Sciences · Mathematics · #Auction Theory and Applications #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Mobile Crowdsensing and Crowdsourcing #Multiagent Systems (cs.MA) #Open Source Software Innovations #Reinforcement Learning in Robotics #cs.LG #cs.MA #stat.ML
  6. VariBAD: A Very Good Method for Bayes-Adaptive Deep RL via Meta-Learning
    2019/10/18 by Luisa Zintgraf, Zintgraf, Luisa, Kyriacos Shiarlis +11 · 1 voice · 26 citations
    Computer Science · Mathematics · #Domain Adaptation and Few-Shot Learning #Gaussian Processes and Bayesian Inference #Machine Learning and Data Classification #cs.LG #stat.ML
  7. Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?
    2020/11/18 by Christian Schroeder de Witt, de Witt, Christian Schroeder, Tarun Gupta +11 · 83 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Artificial Intelligence in Games #FOS: Computer and information sciences #Multi-Agent Systems and Negotiation #Reinforcement Learning in Robotics
  8. Learning with Opponent-Learning Awareness
    2017/09/13 by Jakob N. Foerster, Richard Y. Chen, Foerster, Jakob N. +9 · 1 voice · 27 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Computer Science and Game Theory (cs.GT) #FOS: Computer and information sciences #cs.AI #cs.GT
  9. FACMAC: Factored Multi-Agent Centralised Policy Gradients
    2020/03/14 by Bei Peng, Peng, Bei, Tabish Rashid +11 · 42 citations
    Computer Science · Medicine · #Reinforcement Learning in Robotics #Adaptive Dynamic Programming Control #Mosquito-borne diseases and control
  10. Stabilising Experience Replay for Deep Multi-Agent Reinforcement Learning
    2017/02/28 by Jakob Foerster, Foerster, Jakob, Nantas Nardelli +11 · 38 citations
    Computer Science · Engineering · #Reinforcement Learning in Robotics #Smart Grid Energy Management #Smart Grid Security and Resilience #cs.AI #cs.LG #cs.MA
  11. Weighted QMIX: Expanding Monotonic Value Function Factorisation for Deep Multi-Agent Reinforcement Learning
    2020/01/01 by Tabish Rashid, Rashid, Tabish, Gregory Farquhar +6 · 31 citations
    Computer Science · Engineering · #Advanced Memory and Neural Computing #Adversarial Robustness in Machine Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics
  12. A Tutorial on Meta-Reinforcement Learning
    2023/01/19 by Jacob Beck, Risto Vuorio, Beck, Jacob +11 · 1 voice · 18 citations
    Computer Science · #Data Stream Mining Techniques #FOS: Computer and information sciences #Machine Learning (cs.LG) #Mobile Crowdsensing and Crowdsourcing #Reinforcement Learning in Robotics #cs.LG
  13. SMACv2: An Improved Benchmark for Cooperative Multi-Agent Reinforcement Learning
    2022/12/14 by Benjamin J. Ellis, Ellis, Benjamin, Skander Moalla +12 · 32 citations
    Computer Science · #Reinforcement Learning in Robotics #Machine Learning and Data Classification #Adaptive Dynamic Programming Control
  14. RODE: Learning Roles to Decompose Multi-Agent Tasks
    2020/10/04 by Tonghan Wang, Tarun Gupta, Wang, Tonghan +9 · 25 citations
    Computer Science · #Reinforcement Learning in Robotics #Multimodal Machine Learning Applications #Artificial Intelligence in Games
  15. JaxMARL: Multi-Agent RL Environments and Algorithms in JAX
    2023/11/16 by Alexander R. Rutherford, Benjamin J. Ellis, Rutherford, Alexander +38 · 39 citations
    Computer Science · Social Sciences · #Reinforcement Learning in Robotics #Artificial Intelligence in Games #Digital Games and Media
  16. Imitation Is Not Enough: Robustifying Imitation with Reinforcement Learning for Challenging Driving Scenarios
    2022/12/21 by Yiren Lu, Justin Fu, Lu, Yiren +21 · 28 citations
    Energy · Engineering · #Artificial Intelligence (cs.AI) #Autonomous Vehicle Technology and Safety #Energy, Environment, and Transportation Policies #FOS: Computer and information sciences #I.2.6 #I.2.9 #Robotics (cs.RO) #Traffic and Road Safety
  17. Deep Variational Reinforcement Learning for POMDPs
    2018/06/06 by Maximilian Igl, Luisa Zintgraf, Igl, Maximilian +8 · 17 citations
    Computer Science · Mathematics · #Adversarial Robustness in Machine Learning #Data Stream Mining Techniques #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #cs.LG #stat.ML
  18. A Survey of Reinforcement Learning Informed by Natural Language
    2019/06/10 by Jelena Luketina, Luketina, Jelena, Nantas Nardelli +13 · 16 citations
    Computer Science · Mathematics · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #cs.AI #cs.CL #cs.LG #stat.ML
  19. Relative Upper Confidence Bound for the K-Armed Dueling Bandit Problem
    2013/12/12 by Masrour Zoghi, Zoghi, Masrour, Shimon Whiteson +6 · 16 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Auction Theory and Applications #FOS: Computer and information sciences #Machine Learning (cs.LG) #Optimization and Search Problems #cs.LG
  20. Fast Context Adaptation via Meta-Learning
    2018/10/08 by Luisa M Zintgraf, Luisa Zintgraf, Kyriacos Shiarlis +8 · 25 citations
    Computer Science · Mathematics · #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Data Classification #Machine Learning in Healthcare #cs.LG #stat.ML
  21. Evolution Strategies at the Hyperscale
    2025/11/20 by Bidipta Sarkar, Mattie Fellows, Sarkar, Bidipta +38 · 4 voices · 1 citation
    Computer Science · Mathematics · #Metaheuristic Optimization Algorithms Research #Stochastic Gradient Optimization Techniques #Tensor decomposition and applications #cs.AI #cs.LG
  22. Multi-Objective Deep Reinforcement Learning
    2016/10/09 by Hossam Mossalam, Yannis Assael, Yannis M. Assael +6 · 10 citations
    Computer Science · #Adaptive Dynamic Programming Control #Advanced Multi-Objective Optimization Algorithms #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Reinforcement Learning in Robotics #cs.AI
  23. Transient Non-Stationarity and Generalisation in Deep Reinforcement Learning
    2020/06/10 by Igl, Maximilian, Farquhar, Gregory, Luketina, Jelena +7 · 12 citations
    Computer Science · Physics and Astronomy · #Artificial Intelligence (cs.AI) #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Model Reduction and Neural Networks #Reinforcement Learning in Robotics
  24. TreeQN and ATreeC: Differentiable Tree-Structured Models for Deep Reinforcement Learning
    2017/10/31 by Gregory Farquhar, Farquhar, Gregory, Tim Rocktäschel +5 · 1 voice · 7 citations
    Computer Science · Mathematics · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Neural and Evolutionary Computing (cs.NE) #Reinforcement Learning in Robotics #cs.AI #cs.LG #cs.NE #stat.ML
  25. Bayesian Action Decoder for Deep Multi-Agent Reinforcement Learning
    2018/11/04 by Jakob N. Foerster, Jakob Foerster, Francis Song +14 · 12 citations
    Computer Science · Engineering · #Anomaly Detection Techniques and Applications #Artificial Immune Systems Applications #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics #cs.AI #cs.LG #cs.MA
  26. Deep Coordination Graphs
    2019/09/27 by Wendelin Böhmer, Böhmer, Wendelin, Vitaly Kurin +3 · 10 citations
    Computer Science · #Advanced Graph Neural Networks #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Graph Theory and Algorithms #Machine Learning (cs.LG) #Multiagent Systems (cs.MA) #Optimization and Search Problems #cs.AI #cs.LG #cs.MA
  27. LipNet: End-to-End Sentence-level Lipreading
    2016/11/05 by Yannis M. Assael, Yannis Assael, Assael, Yannis M. +6 · 8 citations
    Computer Science · #Computation and Language (cs.CL) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Music and Audio Processing #Speech Recognition and Synthesis #Speech and Audio Processing #cs.CL #cs.CV #cs.LG
  28. In Defense of the Unitary Scalarization for Deep Multi-Task Learning
    2022/01/11 by Vitaly Kurin, Kurin, Vitaly, Alessandro De Palma +7 · 11 citations
    Computer Science · Decision Sciences · Engineering · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Sparse and Compressive Sensing Techniques #Stochastic Gradient Optimization Techniques
  29. A Survey of In-Context Reinforcement Learning
    2025/02/11 by Amir Moeini, Jiuqi Wang, Moeini, Amir +11 · 1 voice · 14 citations
    Computer Science · Engineering · Neuroscience · #EEG and Brain-Computer Interfaces #FOS: Computer and information sciences #Machine Learning (cs.LG) #Smart Grid Energy Management #cs.LG
  30. UniGen: Unified Modeling of Initial Agent States and Trajectories for Generating Autonomous Driving Scenarios
    2024/05/06 by Reza Mahjourian, Rongbing Mu, Mahjourian, Reza +12 · 2 voices · 3 citations
    Computer Science · Engineering · #Transportation and Mobility Innovations #cs.LG #cs.RO
  31. TACO: Learning Task Decomposition via Temporal Alignment for Control
    2018/03/02 by Kyriacos Shiarlis, Shiarlis, Kyriacos, Markus Wulfmeier +7 · 9 citations
    Computer Science · Engineering · Mathematics · #AI-based Problem Solving and Planning #Reinforcement Learning in Robotics #Robot Manipulation and Learning #cs.LG #stat.ML
  32. Hypernetworks in Meta-Reinforcement Learning
    2022/10/20 by Jacob Beck, Beck, Jacob, Matthew Thomas Jackson +5 · 10 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Evolutionary Algorithms and Applications #FOS: Computer and information sciences #Machine Learning (cs.LG) #Mobile Crowdsensing and Crowdsourcing #Reinforcement Learning in Robotics #Robotics (cs.RO)
  33. Symphony: Learning Realistic and Diverse Agents for Autonomous Driving Simulation
    2022/05/06 by Maximilian Igl, Igl, Maximilian, Dae Woo Kim +17 · 9 citations
    Engineering · #Autonomous Vehicle Technology and Safety #FOS: Computer and information sciences #Machine Learning (cs.LG) #Robotics (cs.RO)
  34. Growing Action Spaces
    2019/06/28 by Gregory Farquhar, Farquhar, Gregory, Laura Gustafson +9 · 6 citations
    Computer Science · Mathematics · Social Sciences · #Artificial Intelligence (cs.AI) #Artificial Intelligence in Games #Digital Games and Media #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #cs.AI #cs.LG #stat.ML
  35. Universal Morphology Control via Contextual Modulation
    2023/02/22 by Zheng Xiong, Xiong, Zheng, Jacob Beck +3 · 9 citations
    Computer Science · Engineering · #Advanced Graph Neural Networks #Advanced Memory and Neural Computing #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Robotics (cs.RO)
  36. Multi-Agent Common Knowledge Reinforcement Learning
    2018/10/27 by Christian A. Schroeder de Witt, de Witt, Christian A. Schroeder, Jakob N. Foerster +10 · 7 citations
    Computer Science · Social Sciences · #Evolutionary Game Theory and Cooperation #Experimental Behavioral Economics Studies #Reinforcement Learning in Robotics #cs.AI #cs.GT #cs.LG #cs.MA
  37. Breaking the Deadly Triad with a Target Network
    2021/01/21 by Shangtong Zhang, Hengshuai Yao, Zhang, Shangtong +3 · 7 citations
    Computer Science · Decision Sciences · #Adaptive Dynamic Programming Control #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
  38. UneVEn: Universal Value Exploration for Multi-Agent Reinforcement\n Learning
    2020/10/06 by Tarun Gupta, Anuj Mahajan, Gupta, Tarun +7 · 6 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Data Stream Mining Techniques #Explainable Artificial Intelligence (XAI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics
  39. Stable Opponent Shaping in Differentiable Games
    2018/11/20 by Alistair Letcher, Letcher, Alistair, Jakob Foerster +7 · 6 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Game Theory and Applications #Machine Learning (cs.LG) #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics
  40. DAC: The Double Actor-Critic Architecture for Learning Options
    2019/04/29 by Shangtong Zhang, Zhang, Shangtong, Shimon Whiteson +1 · 5 citations
    Computer Science · Mathematics · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #cs.AI #cs.LG #stat.ML
  41. Copeland Dueling Bandits
    2015/06/01 by Masrour Zoghi, Zoghi, Masrour, Zohar Karnin +5 · 4 citations
    Business, Management and Accounting · Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Auction Theory and Applications #Consumer Market Behavior and Pricing #FOS: Computer and information sciences #Machine Learning (cs.LG) #cs.LG
  42. Policy-Guided Diffusion
    2024/04/09 by Matthew Thomas Jackson, Jackson, Matthew Thomas, Michael Matthews +9 · 10 citations
    Computer Science · #Reinforcement Learning in Robotics #Domain Adaptation and Few-Shot Learning #Generative Adversarial Networks and Image Synthesis
  43. Optimistic Exploration even with a Pessimistic Initialisation
    2020/02/26 by Tabish Rashid, Rashid, Tabish, Bei Peng +5 · 5 citations
    Computer Science · Decision Sciences · Mathematics · Neuroscience · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Neural dynamics and brain function #Reinforcement Learning in Robotics #cs.AI #cs.LG #stat.ML
  44. Randomized Entity-wise Factorization for Multi-Agent Reinforcement Learning
    2020/06/07 by Shariq Iqbal, Christian A. Schroeder de Witt, Iqbal, Shariq +9 · 5 citations
    Computer Science · #Reinforcement Learning in Robotics #Data Stream Mining Techniques #Artificial Intelligence in Games
  45. Equivariant Networks for Zero-Shot Coordination
    2022/10/21 by Darius Muglich, Muglich, Darius, Christian Schroeder de Witt +7 · 6 citations
    Computer Science · #Explainable Artificial Intelligence (XAI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics #Topic Modeling
  46. Mean-Variance Policy Iteration for Risk-Averse Reinforcement Learning
    2020/04/22 by Shangtong Zhang, Bo Liu, Zhang, Shangtong +3 · 4 citations
    Computer Science · Medicine · #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Neurological disorders and treatments #Reinforcement Learning in Robotics
  47. Tesseract: Tensorised Actors for Multi-Agent Reinforcement Learning
    2021/05/31 by Anuj Mahajan, Mahajan, Anuj, Mikayel Samvelyan +15 · 5 citations
    Engineering · Mathematics · Physics and Astronomy · #FOS: Computer and information sciences #Lattice Boltzmann Simulation Studies #Machine Learning (cs.LG) #Model Reduction and Neural Networks #Tensor decomposition and applications
  48. DiCE: The Infinitely Differentiable Monte-Carlo Estimator
    2018/02/14 by Jakob Foerster, Foerster, Jakob, Gregory Farquhar +9 · 3 citations
    Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Neural and Evolutionary Computing (cs.NE) #cs.AI #cs.LG #cs.NE
  49. VIREL: A Variational Inference Framework for Reinforcement Learning
    2018/11/03 by Matthew Fellows, Anuj Mahajan, Fellows, Matthew +5 · 4 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Adversarial Robustness in Machine Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics
  50. Average-Reward Off-Policy Policy Evaluation with Function Approximation
    2021/01/08 by Shangtong Zhang, Zhang, Shangtong, Yi Wan +5 · 6 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Optimization and Search Problems #Reinforcement Learning in Robotics
  51. Exploration with Unreliable Intrinsic Reward in Multi-Agent Reinforcement Learning
    2019/06/05 by Wendelin Böhmer, Böhmer, Wendelin, Tabish Rashid +3 · 6 citations
    Computer Science · Neuroscience · #Adaptive Dynamic Programming Control #Neural and Behavioral Psychology Studies #Reinforcement Learning in Robotics #cs.AI
  52. Regularized Softmax Deep Multi-Agent Q-Learning
    2021/03/22 by Ling Pan, Tabish Rashid, Pan, Ling +7 · 3 citations
    Computer Science · #Distributed Control Multi-Agent Systems #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and ELM #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics
  53. Provably Convergent Two-Timescale Off-Policy Actor-Critic with Function Approximation
    2019/11/11 by Shangtong Zhang, Zhang, Shangtong, Bo Liu +5 · 9 citations
    Computer Science · Physics and Astronomy · #Adaptive Dynamic Programming Control #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Model Reduction and Neural Networks #Reinforcement Learning in Robotics
  54. Stochastic Optimization for Collision Selection in High Energy Physics
    2006/07/10 by Shimon Whiteson, S. Whiteson, Whiteson, S. +2 · 2 citations
    Computer Science · Decision Sciences · Physics and Astronomy · #Algorithms and Data Compression #FOS: Physical sciences #High Energy Physics - Experiment (hep-ex) #Machine Learning and Algorithms #Simulation Techniques and Applications #hep-ex
  55. Privileged Information Dropout in Reinforcement Learning
    2020/05/19 by Pierre-Alexandre Kamienny, Kai Arulkumaran, Kamienny, Pierre-Alexandre +7 · 2 citations
    Computer Science · Mathematics · #Artificial Intelligence (cs.AI) #Data Stream Mining Techniques #Evolutionary Algorithms and Applications #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #cs.AI #cs.LG #stat.ML
  56. WordCraft: An Environment for Benchmarking Commonsense Agents
    2020/07/17 by Minqi Jiang, Jiang, Minqi, Jelena Luketina +11 · 2 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Natural Language Processing Techniques #Reinforcement Learning in Robotics #Topic Modeling
  57. Distilling Morphology-Conditioned Hypernetworks for Efficient Universal Morphology Control
    2024/02/09 by Xiong Zheng, Risto Vuorio, Xiong, Zheng +9 · 4 citations
    Engineering · #Modular Robots and Swarm Intelligence
  58. Exploration in Approximate Hyper-State Space for Meta Reinforcement\n Learning
    2020/10/02 by Luisa Zintgraf, Leo Feng, Zintgraf, Luisa +12 · 2 citations
    Computer Science · #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #Data Stream Mining Techniques #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Data Classification #Reinforcement Learning in Robotics
  59. Communicating via Markov Decision Processes
    2021/07/17 by Samuel Sokota, Sokota, Samuel, Christian Schroeder de Witt +15 · 2 citations
    Computer Science · Engineering · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics #Wireless Communication Security Techniques
  60. Deep Residual Reinforcement Learning
    2019/05/03 by Shangtong Zhang, Zhang, Shangtong, Wendelin Boehmer +3 · 2 citations
    Computer Science · Engineering · Mathematics · #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Robot Manipulation and Learning #cs.AI #cs.LG #stat.ML
  61. You May Not Need Ratio Clipping in PPO
    2022/01/31 by Mingfei Sun, Sun, Mingfei, Vitaly Kurin +11 · 2 citations
    Computer Science · #Machine Learning and Algorithms #Advanced Multi-Objective Optimization Algorithms #Machine Learning and Data Classification
  62. A Survey of Multi-Objective Sequential Decision-Making
    2014/02/04 by Diederik Marijn Roijers, Peter Vamplew, Shimon Whiteson +1 · 1 citation
    Computer Science · #cs.AI
  63. Truncated Emphatic Temporal Difference Methods for Prediction and Control
    2021/08/11 by Shangtong Zhang, Shimon Whiteson, Zhang, Shangtong +1 · 4 citations
    Computer Science · Engineering · #FOS: Computer and information sciences #Fuel Cells and Related Materials #Machine Learning (cs.LG) #Real-time simulation and control systems #Reinforcement Learning in Robotics
  64. Learning to Drive in New Cities Without Human Demonstrations
    2026/02/09 by Zilin Wang, Saeed Rahmani, Daphne Cornelisse +4 · 2 voices · 3 citations
    Computer Science · #cs.RO #cs.LG #cs.MA
  65. Recurrent Hypernetworks are Surprisingly Strong in Meta-RL
    2023/09/26 by Jacob Beck, Beck, Jacob, Risto Vuorio +5 · 1 voice · 2 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and Data Classification #Reinforcement Learning in Robotics #Robotics (cs.RO) #cs.AI #cs.LG #cs.RO
  66. Expected Policy Gradients
    2017/06/15 by Kamil Ciosek, Shimon Whiteson, Ciosek, Kamil +1 · 2 citations
    Computer Science · Mathematics · #90C40 #FOS: Computer and information sciences #G.3 #I.2.8 #Machine Learning (cs.LG) #Machine Learning (stat.ML) #acm:90C40 #cs.LG #msc:90C40 #stat.ML
  67. Learning from Demonstration in the Wild
    2018/11/08 by Feryal Behbahani, Kyriacos Shiarlis, Behbahani, Feryal +19 · 1 citation
    Computer Science · Mathematics · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #cs.LG #stat.ML
  68. Adam on Local Time: Addressing Nonstationarity in RL with Relative Adam Timesteps
    2024/12/22 by Benjamin J. Ellis, Ellis, Benjamin, Matthew Jackson +11 · 5 citations
    Computer Science · #Multi-Agent Systems and Negotiation #Logic, Reasoning, and Knowledge
  69. Loaded DiCE: Trading off Bias and Variance in Any-Order Score Function Estimators for Reinforcement Learning
    2019/09/23 by Gregory Farquhar, Shimon Whiteson, Farquhar, Gregory +3 · 1 citation
    Computer Science · Mathematics · Psychology · #Advanced Multi-Objective Optimization Algorithms #Data Stream Mining Techniques #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Mental Health Research Topics #Reinforcement Learning in Robotics #cs.LG #stat.ML
  70. Multitask Soft Option Learning
    2019/04/01 by Maximilian Igl, Andrew Gambardella, Igl, Maximilian +11 · 1 citation
    Computer Science · Economics, Econometrics and Finance · Engineering · Mathematics · #Capital Investment and Risk Analysis #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Reservoir Engineering and Simulation Methods #cs.LG #stat.ML
  71. A Clean Slate for Offline Reinforcement Learning
    2025/04/15 by Matthew Thomas Jackson, Jackson, Matthew Thomas, Uljad Berdica +8 · 1 voice · 3 citations
    Computer Science · #Machine Learning and Data Classification #Reinforcement Learning in Robotics #Stochastic Gradient Optimization Techniques #cs.AI #cs.LG #cs.RO
  72. Discovering General Reinforcement Learning Algorithms with Adversarial Environment Design
    2023/10/04 by Matthew Thomas Jackson, Jackson, Matthew Thomas, Minqi Jiang +13 · 2 citations
    Decision Sciences · Computer Science · #Advanced Bandit Algorithms Research #Machine Learning and Data Classification #Reinforcement Learning in Robotics
  73. Deterministic and Discriminative Imitation (D2-Imitation): Revisiting Adversarial Imitation for Sample Efficiency
    2021/12/11 by Mingfei Sun, Sun, Mingfei, Sam Devlin +5 · 1 citation
    Computer Science · Engineering · #Adversarial Robustness in Machine Learning #Reinforcement Learning in Robotics #Robot Manipulation and Learning
  74. On the Practical Consistency of Meta-Reinforcement Learning Algorithms
    2021/12/01 by Zheng Xiong, Xiong, Zheng, Luisa Zintgraf +7 · 1 citation
    Computer Science · #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Data Classification #Reinforcement Learning in Robotics
  75. Fourier Policy Gradients
    2018/02/19 by Matthew Fellows, Kamil Ciosek, Fellows, Matthew +3 · 1 voice
    Computer Science · Engineering · #Adaptive Dynamic Programming Control #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Fuel Cells and Related Materials #Machine Learning (cs.LG) #Reinforcement Learning in Robotics #cs.AI #cs.LG
  76. Hierarchical Imitation Learning for Stochastic Environments
    2023/09/25 by Maximilian Igl, Igl, Maximilian, Punit Shah +13 · 1 citation
    Engineering · Computer Science · #Autonomous Vehicle Technology and Safety #Human Pose and Action Recognition #Explainable Artificial Intelligence (XAI)
  77. Trust Region Bounds for Decentralized PPO Under Non-stationarity
    2022/01/31 by Mingfei Sun, Sun, Mingfei, Sam Devlin +6 · 2 citations
    Computer Science · Decision Sciences · #Adaptive Dynamic Programming Control #Auction Theory and Applications #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
  78. Generalized Off-Policy Actor-Critic
    2019/03/27 by Shangtong Zhang, Zhang, Shangtong, Wendelin Boehmer +3 · 1 citation
    Computer Science · Mathematics · #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Software Testing and Debugging Techniques #cs.AI #cs.LG #stat.ML
  79. A Bayesian Solution To The Imitation Gap
    2024/06/29 by Risto Vuorio, Vuorio, Risto, Mattie Fellows +7 · 1 citation
    Computer Science · Decision Sciences · Engineering · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics #Robot Manipulation and Learning
  80. HyperVLA: Efficient Inference in Vision-Language-Action Models via Hypernetworks
    2025/10/06 by Zheng Xiong, Kang Li, Xiong, Zheng +9 · 3 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multimodal Machine Learning Applications #Reinforcement Learning in Robotics #Robotics (cs.RO)