vix.ing · top · new · best · stats · spec

Kaiqing Zhang

  1. Multi-Agent Reinforcement Learning: A Selective Overview of Theories and Algorithms
    2019/11/24 by Kaiqing Zhang, Zhuoran Yang, Zhang, Kaiqing +3 · 51 citations
    Decision Sciences · #Innovation Diffusion and Forecasting
  2. Fully Decentralized Multi-Agent Reinforcement Learning with Networked Agents
    2018/02/23 by Kaiqing Zhang, Zhuoran Yang, Zhang, Kaiqing +7 · 19 citations
    Computer Science · #Adaptive Dynamic Programming Control #Artificial Intelligence (cs.AI) #Distributed Control Multi-Agent Systems #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Multiagent Systems (cs.MA) #Optimization and Control (math.OC) #Reinforcement Learning in Robotics
  3. Learning Safe Multi-Agent Control with Decentralized Neural Barrier Certificates
    2021/01/14 by Zengyi Qin, Kaiqing Zhang, Qin, Zengyi +7 · 9 citations
    Computer Science · Engineering · #Advanced Control Systems Optimization #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #FOS: Electrical engineering #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics #Robotic Path Planning Algorithms #Systems and Control (eess.SY) #electronic engineering #information engineering
  4. MAPoRL: Multi-Agent Post-Co-Training for Collaborative Large Language Models with Reinforcement Learning
    2025/02/25 by Chanwoo Park, Park, Chanwoo, Seungju Han +9 · 20 citations
    Computer Science · #Natural Language Processing Techniques #Topic Modeling #Speech and dialogue systems
  5. The Power of Regularization in Solving Extensive-Form Games
    2022/06/19 by Mingyang Liu, Asuman Ozdaglar, Liu, Mingyang +5 · 5 citations
    Decision Sciences · Computer Science · Economics, Econometrics and Finance · #Advanced Bandit Algorithms Research #Reinforcement Learning in Robotics #Sports Analytics and Performance
  6. Offline Reinforcement Learning via Linear-Programming with Error-Bound Induced Constraints
    2022/12/28 by Asuman Ozdaglar, Ozdaglar, Asuman, Sarath Pattathil +5 · 3 citations
    Computer Science · #Adversarial Robustness in Machine Learning #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Control (math.OC) #Reinforcement Learning in Robotics
  7. Last-Iterate Convergent Policy Gradient Primal-Dual Methods for Constrained MDPs
    2023/06/20 by Dong-Sheng Ding, Ding, Dongsheng, Chen-Yu Wei +5 · 3 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #FOS: Electrical engineering #FOS: Mathematics #Machine Learning (cs.LG) #Optimization and Control (math.OC) #Reinforcement Learning in Robotics #Stochastic Gradient Optimization Techniques #Systems and Control (eess.SY) #electronic engineering #information engineering
  8. Model-Free Non-Stationary RL: Near-Optimal Regret and Applications in Multi-Agent RL and Inventory Control
    2020/10/07 by Weichao Mao, Mao, Weichao, Kaiqing Zhang +7 · 2 citations
    Computer Science · Decision Sciences · Engineering · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Smart Grid Energy Management
  9. Independent Learning in Stochastic Games
    2021/11/23 by Asuman Ozdaglar, Muhammed O. Sayin, Ozdaglar, Asuman +3 · 2 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Computer Science and Game Theory (cs.GT) #Dynamical Systems (math.DS) #FOS: Computer and information sciences #FOS: Mathematics #Game Theory and Applications #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
  10. Provable Partially Observable Reinforcement Learning with Privileged Information
    2024/12/01 by Yang Cai, Cai, Yang, Xiangyu Liu +5 · 5 citations
    Computer Science · Engineering · #Reinforcement Learning in Robotics #Elevator Systems and Control #Adaptive Dynamic Programming Control
  11. Decentralized Multi-Agent Reinforcement Learning with Networked Agents: Recent Advances
    2019/12/09 by Kaiqing Zhang, Zhuoran Yang, Zhang, Kaiqing +3 · 3 citations
    Computer Science · #Distributed Control Multi-Agent Systems #Reinforcement Learning in Robotics #Age of Information Optimization
  12. A Communication-Efficient Multi-Agent Actor-Critic Algorithm for Distributed Reinforcement Learning
    2019/07/06 by Yixuan Lin, Kaiqing Zhang, Lin, Yixuan +11 · 1 citation
    Computer Science · #Adaptive Dynamic Programming Control #Distributed Control Multi-Agent Systems #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics
  13. Information State Embedding in Partially Observable Cooperative Multi-Agent Reinforcement Learning
    2020/04/02 by Weichao Mao, Kaiqing Zhang, Mao, Weichao +5 · 1 citation
    Computer Science · Engineering · #Reinforcement Learning in Robotics #Adaptive Dynamic Programming Control #Advanced Control Systems Optimization
  14. Independent Policy Gradient for Large-Scale Markov Potential Games: Sharper Rates, Function Approximation, and Game-Agnostic Convergence
    2022/02/08 by Dong-Sheng Ding, Chen-Yu Wei, Ding, Dongsheng +5 · 1 citation
    Computer Science · Decision Sciences · #Reinforcement Learning in Robotics #Distributed Control Multi-Agent Systems #Advanced Bandit Algorithms Research
  15. What is a Good Metric to Study Generalization of Minimax Learners?
    2022/06/09 by Asuman Ozdaglar, Sarath Pattathil, Ozdaglar, Asuman +5 · 1 citation
    Computer Science · Engineering · #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Control (math.OC) #Sparse and Compressive Sensing Techniques #Stochastic Gradient Optimization Techniques
  16. Fictitious Play in Markov Games with Single Controller
    2022/05/23 by Muhammed O. Sayin, Kaiqing Zhang, Sayin, Muhammed O. +3 · 1 citation
    Decision Sciences · Social Sciences · #Computer Science and Game Theory (cs.GT) #Decision-Making and Behavioral Economics #Experimental Behavioral Economics Studies #FOS: Computer and information sciences #Game Theory and Applications
  17. Learning to Extrapolate: A Transductive Approach
    2023/04/27 by Aviv Netanyahu, Netanyahu, Aviv, Abhishek Gupta +7 · 1 citation
    Computer Science · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and Algorithms #Machine Learning and Data Classification #Topic Modeling
  18. Finite-Sample Analysis For Decentralized Batch Multi-Agent Reinforcement Learning With Networked Agents
    2018/12/06 by Kaiqing Zhang, Zhuoran Yang, Zhang, Kaiqing +7 · 1 citation
    Computer Science · Decision Sciences · #Distributed Control Multi-Agent Systems #Game Theory and Applications #Reinforcement Learning in Robotics
  19. A Finite-Sample Analysis of Payoff-Based Independent Learning in Zero-Sum Stochastic Games
    2023/03/03 by Zaiwei Chen, Chen, Zaiwei, Kaiqing Zhang +7 · 1 citation
    Decision Sciences · Mathematics · #Advanced Bandit Algorithms Research #Auction Theory and Applications #Computer Science and Game Theory (cs.GT) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Markov Chains and Monte Carlo Methods
  20. Two-Timescale Q-Learning with Function Approximation in Zero-Sum Stochastic Games
    2023/12/08 by Zaiwei Chen, Kaiqing Zhang, Chen, Zaiwei +7 · 1 citation
    Computer Science · Decision Sciences · Mathematics · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Markov Chains and Monte Carlo Methods #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics
  21. First Lasing and Stable Operation of a Direct-Amplification Enabled Harmonic Generation Free-Electron laser
    2025/05/18 by Zheng Qi, Junhao Liu, Qi, Zheng +57 · 2 citations
    Engineering · Physics and Astronomy · #Accelerator Physics (physics.acc-ph) #Crystallography and Radiation Phenomena #FOS: Physical sciences #Laser-Plasma Interactions and Diagnostics #Particle Accelerators and Free-Electron Lasers
  22. Biodegradable, Millimeter-Scale Light-Emitting Sensors for Distributed Environmental Monitoring-Functional Pixie Dust
    2026/07/20 by Zhiming Hu, Danzhen Zhang, Janghun Ko +24
    #physics.app-ph