Kuba, Jakub Grudzien
- Multi-Agent Reinforcement Learning is a Sequence Modeling Problem
2022/05/30 by Muning Wen, Jakub Grudzien Kuba, Wen, Muning +11 · 2 voices · 27 citations
#cs.MA #cs.LG
- IDQL: Implicit Q-Learning as an Actor-Critic Method with Diffusion Policies
2023/04/20 by Philippe Hansen-Estruch, Ilya Kostrikov, Hansen-Estruch, Philippe +7 · 42 citations
Mathematics · Psychology · #Advanced Causal Inference Techniques #Mental Health Research Topics
- Trust Region Policy Optimisation in Multi-Agent Reinforcement Learning
2021/09/23 by Kuba, Jakub Grudzien, Chen, Ruiqing, Wen, Muning +4 · 23 citations
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Multiagent Systems (cs.MA)
- Heterogeneous-Agent Reinforcement Learning
2023/04/19 by Yifan Zhong, Zhong, Yifan, Jakub Grudzien Kuba +8 · 19 citations
Computer Science · #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Mobile Crowdsensing and Crowdsourcing #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics
- Discovered Policy Optimisation
2022/10/11 by Lu, Chris, Kuba, Jakub Grudzien, Letcher, Alistair +3 · 17 citations
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG)
- Settling the Variance of Multi-Agent Policy Gradients
2021/08/19 by Kuba, Jakub Grudzien, Wen, Muning, Yang, Yaodong +5 · 8 citations
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multiagent Systems (cs.MA)
- Multi-Agent Constrained Policy Optimisation
2021/10/06 by Shangding Gu, Gu, Shangding, Jakub Grudzien Kuba +13 · 6 citations
Computer Science · Engineering · #Reinforcement Learning in Robotics #Autonomous Vehicle Technology and Safety #Robot Manipulation and Learning
- Heterogeneous-Agent Mirror Learning: A Continuum of Solutions to Cooperative MARL
2022/08/02 by Kuba, Jakub Grudzien, Feng, Xidong, Ding, Shiyao +3 · 3 citations
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Multiagent Systems (cs.MA)
- Language Self-Play For Data-Free Training
2025/09/09 by Jakub Grudzien Kuba, Kuba, Jakub Grudzien, M. F. Gu +8 · 17 citations
Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #Computer Science and Game Theory (cs.GT) #FOS: Computer and information sciences #Multimodal Machine Learning Applications #Reinforcement Learning in Robotics #Topic Modeling
- Mirror Learning: A Unifying Framework of Policy Optimisation
2022/01/07 by Kuba, Jakub Grudzien, de Witt, Christian Schroeder, Foerster, Jakob · 2 citations
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG)
- Understanding Value Decomposition Algorithms in Deep Cooperative Multi-Agent Reinforcement Learning
2022/02/10 by Dou, Zehao, Kuba, Jakub Grudzien, Yang, Yaodong · 1 citation
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
- Functional Graphical Models: Structure Enables Offline Data-Driven Optimization
2024/01/08 by Jakub Grudzien Kuba, Masatoshi Uehara, Kuba, Jakub Grudzien +5 · 1 citation
Computer Science · Materials Science · #Artificial Intelligence (cs.AI) #Computational Drug Discovery Methods #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and Data Classification #Machine Learning in Materials Science