vix.ing · top · new · best · stats · spec

Kuba, Jakub Grudzien

  1. Multi-Agent Reinforcement Learning is a Sequence Modeling Problem
    2022/05/30 by Muning Wen, Jakub Grudzien Kuba, Wen, Muning +11 · 2 voices · 27 citations
    #cs.MA #cs.LG
  2. IDQL: Implicit Q-Learning as an Actor-Critic Method with Diffusion Policies
    2023/04/20 by Philippe Hansen-Estruch, Ilya Kostrikov, Hansen-Estruch, Philippe +7 · 42 citations
    Mathematics · Psychology · #Advanced Causal Inference Techniques #Mental Health Research Topics
  3. Trust Region Policy Optimisation in Multi-Agent Reinforcement Learning
    2021/09/23 by Kuba, Jakub Grudzien, Chen, Ruiqing, Wen, Muning +4 · 23 citations
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Multiagent Systems (cs.MA)
  4. Heterogeneous-Agent Reinforcement Learning
    2023/04/19 by Yifan Zhong, Zhong, Yifan, Jakub Grudzien Kuba +8 · 19 citations
    Computer Science · #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Mobile Crowdsensing and Crowdsourcing #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics
  5. Discovered Policy Optimisation
    2022/10/11 by Lu, Chris, Kuba, Jakub Grudzien, Letcher, Alistair +3 · 17 citations
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG)
  6. Settling the Variance of Multi-Agent Policy Gradients
    2021/08/19 by Kuba, Jakub Grudzien, Wen, Muning, Yang, Yaodong +5 · 8 citations
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multiagent Systems (cs.MA)
  7. Multi-Agent Constrained Policy Optimisation
    2021/10/06 by Shangding Gu, Gu, Shangding, Jakub Grudzien Kuba +13 · 6 citations
    Computer Science · Engineering · #Reinforcement Learning in Robotics #Autonomous Vehicle Technology and Safety #Robot Manipulation and Learning
  8. Heterogeneous-Agent Mirror Learning: A Continuum of Solutions to Cooperative MARL
    2022/08/02 by Kuba, Jakub Grudzien, Feng, Xidong, Ding, Shiyao +3 · 3 citations
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Multiagent Systems (cs.MA)
  9. Language Self-Play For Data-Free Training
    2025/09/09 by Jakub Grudzien Kuba, Kuba, Jakub Grudzien, M. F. Gu +8 · 17 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #Computer Science and Game Theory (cs.GT) #FOS: Computer and information sciences #Multimodal Machine Learning Applications #Reinforcement Learning in Robotics #Topic Modeling
  10. Mirror Learning: A Unifying Framework of Policy Optimisation
    2022/01/07 by Kuba, Jakub Grudzien, de Witt, Christian Schroeder, Foerster, Jakob · 2 citations
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG)
  11. Understanding Value Decomposition Algorithms in Deep Cooperative Multi-Agent Reinforcement Learning
    2022/02/10 by Dou, Zehao, Kuba, Jakub Grudzien, Yang, Yaodong · 1 citation
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
  12. Functional Graphical Models: Structure Enables Offline Data-Driven Optimization
    2024/01/08 by Jakub Grudzien Kuba, Masatoshi Uehara, Kuba, Jakub Grudzien +5 · 1 citation
    Computer Science · Materials Science · #Artificial Intelligence (cs.AI) #Computational Drug Discovery Methods #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and Data Classification #Machine Learning in Materials Science