vix.ing · top · new · best · stats · spec

Tabish Rashid

  1. The StarCraft Multi-Agent Challenge
    2019/02/11 by Mikayel Samvelyan, Tabish Rashid, Samvelyan, Mikayel +17 · 1 voice · 61 citations
    Computer Science · Mathematics · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Multiagent Systems (cs.MA) #cs.LG #cs.MA #stat.ML
  2. QMIX: Monotonic Value Function Factorisation for Deep Multi-Agent Reinforcement Learning
    2018/03/30 by Tabish Rashid, Rashid, Tabish, Mikayel Samvelyan +9 · 49 citations
    Computer Science · Decision Sciences · #Auction Theory and Applications #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Mobile Crowdsensing and Crowdsourcing #Multiagent Systems (cs.MA) #Open Source Software Innovations #Reinforcement Learning in Robotics
  3. FACMAC: Factored Multi-Agent Centralised Policy Gradients
    2020/03/14 by Bei Peng, Tabish Rashid, Peng, Bei +11 · 29 citations
    Computer Science · Medicine · #Reinforcement Learning in Robotics #Adaptive Dynamic Programming Control #Mosquito-borne diseases and control
  4. Weighted QMIX: Expanding Monotonic Value Function Factorisation for Deep Multi-Agent Reinforcement Learning
    2020/01/01 by Tabish Rashid, Gregory Farquhar, Rashid, Tabish +6 · 20 citations
    Computer Science · Engineering · #Advanced Memory and Neural Computing #Adversarial Robustness in Machine Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics
  5. Scaling Laws for Pre-training Agents and World Models
    2024/11/07 by Tim Pearce, Tabish Rashid, Pearce, Tim +9 · 1 voice · 5 citations
    #cs.LG #cs.AI
  6. Exploration with Unreliable Intrinsic Reward in Multi-Agent Reinforcement Learning
    2019/06/05 by Wendelin Böhmer, Böhmer, Wendelin, Tabish Rashid +3 · 6 citations
    Computer Science · Neuroscience · #Reinforcement Learning in Robotics #Neural and Behavioral Psychology Studies #Adaptive Dynamic Programming Control
  7. Optimistic Exploration even with a Pessimistic Initialisation
    2020/02/26 by Tabish Rashid, Rashid, Tabish, Bei Peng +4 · 2 citations
    Computer Science · Decision Sciences · Neuroscience · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Neural dynamics and brain function #Reinforcement Learning in Robotics
  8. Regularized Softmax Deep Multi-Agent Q-Learning
    2021/03/22 by Ling Pan, Pan, Ling, Tabish Rashid +7 · 1 citation
    Computer Science · #Distributed Control Multi-Agent Systems #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and ELM #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics