Kaiqing Zhang
- Multi-Agent Reinforcement Learning: A Selective Overview of Theories and Algorithms
2019/11/24 by Kaiqing Zhang, Zhuoran Yang, Zhang, Kaiqing +3 · 51 citations
Decision Sciences · #Innovation Diffusion and Forecasting
- Fully Decentralized Multi-Agent Reinforcement Learning with Networked Agents
2018/02/23 by Kaiqing Zhang, Zhuoran Yang, Zhang, Kaiqing +7 · 19 citations
Computer Science · #Adaptive Dynamic Programming Control #Artificial Intelligence (cs.AI) #Distributed Control Multi-Agent Systems #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Multiagent Systems (cs.MA) #Optimization and Control (math.OC) #Reinforcement Learning in Robotics
- Learning Safe Multi-Agent Control with Decentralized Neural Barrier Certificates
2021/01/14 by Zengyi Qin, Kaiqing Zhang, Qin, Zengyi +7 · 9 citations
Computer Science · Engineering · #Advanced Control Systems Optimization #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #FOS: Electrical engineering #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics #Robotic Path Planning Algorithms #Systems and Control (eess.SY) #electronic engineering #information engineering
- MAPoRL: Multi-Agent Post-Co-Training for Collaborative Large Language Models with Reinforcement Learning
2025/02/25 by Chanwoo Park, Park, Chanwoo, Seungju Han +9 · 20 citations
Computer Science · #Natural Language Processing Techniques #Topic Modeling #Speech and dialogue systems
- The Power of Regularization in Solving Extensive-Form Games
2022/06/19 by Mingyang Liu, Asuman Ozdaglar, Liu, Mingyang +5 · 5 citations
Decision Sciences · Computer Science · Economics, Econometrics and Finance · #Advanced Bandit Algorithms Research #Reinforcement Learning in Robotics #Sports Analytics and Performance
- Offline Reinforcement Learning via Linear-Programming with Error-Bound Induced Constraints
2022/12/28 by Asuman Ozdaglar, Ozdaglar, Asuman, Sarath Pattathil +5 · 3 citations
Computer Science · #Adversarial Robustness in Machine Learning #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Control (math.OC) #Reinforcement Learning in Robotics
- Last-Iterate Convergent Policy Gradient Primal-Dual Methods for Constrained MDPs
2023/06/20 by Dong-Sheng Ding, Ding, Dongsheng, Chen-Yu Wei +5 · 3 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #FOS: Electrical engineering #FOS: Mathematics #Machine Learning (cs.LG) #Optimization and Control (math.OC) #Reinforcement Learning in Robotics #Stochastic Gradient Optimization Techniques #Systems and Control (eess.SY) #electronic engineering #information engineering
- Model-Free Non-Stationary RL: Near-Optimal Regret and Applications in Multi-Agent RL and Inventory Control
2020/10/07 by Weichao Mao, Mao, Weichao, Kaiqing Zhang +7 · 2 citations
Computer Science · Decision Sciences · Engineering · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Smart Grid Energy Management
- Independent Learning in Stochastic Games
2021/11/23 by Asuman Ozdaglar, Muhammed O. Sayin, Ozdaglar, Asuman +3 · 2 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Computer Science and Game Theory (cs.GT) #Dynamical Systems (math.DS) #FOS: Computer and information sciences #FOS: Mathematics #Game Theory and Applications #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
- Provable Partially Observable Reinforcement Learning with Privileged Information
2024/12/01 by Yang Cai, Cai, Yang, Xiangyu Liu +5 · 5 citations
Computer Science · Engineering · #Reinforcement Learning in Robotics #Elevator Systems and Control #Adaptive Dynamic Programming Control
- Decentralized Multi-Agent Reinforcement Learning with Networked Agents: Recent Advances
2019/12/09 by Kaiqing Zhang, Zhuoran Yang, Zhang, Kaiqing +3 · 3 citations
Computer Science · #Distributed Control Multi-Agent Systems #Reinforcement Learning in Robotics #Age of Information Optimization
- A Communication-Efficient Multi-Agent Actor-Critic Algorithm for Distributed Reinforcement Learning
2019/07/06 by Yixuan Lin, Kaiqing Zhang, Lin, Yixuan +11 · 1 citation
Computer Science · #Adaptive Dynamic Programming Control #Distributed Control Multi-Agent Systems #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics
- Information State Embedding in Partially Observable Cooperative Multi-Agent Reinforcement Learning
2020/04/02 by Weichao Mao, Kaiqing Zhang, Mao, Weichao +5 · 1 citation
Computer Science · Engineering · #Reinforcement Learning in Robotics #Adaptive Dynamic Programming Control #Advanced Control Systems Optimization
- Independent Policy Gradient for Large-Scale Markov Potential Games: Sharper Rates, Function Approximation, and Game-Agnostic Convergence
2022/02/08 by Dong-Sheng Ding, Chen-Yu Wei, Ding, Dongsheng +5 · 1 citation
Computer Science · Decision Sciences · #Reinforcement Learning in Robotics #Distributed Control Multi-Agent Systems #Advanced Bandit Algorithms Research
- What is a Good Metric to Study Generalization of Minimax Learners?
2022/06/09 by Asuman Ozdaglar, Sarath Pattathil, Ozdaglar, Asuman +5 · 1 citation
Computer Science · Engineering · #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Control (math.OC) #Sparse and Compressive Sensing Techniques #Stochastic Gradient Optimization Techniques
- Fictitious Play in Markov Games with Single Controller
2022/05/23 by Muhammed O. Sayin, Kaiqing Zhang, Sayin, Muhammed O. +3 · 1 citation
Decision Sciences · Social Sciences · #Computer Science and Game Theory (cs.GT) #Decision-Making and Behavioral Economics #Experimental Behavioral Economics Studies #FOS: Computer and information sciences #Game Theory and Applications
- Learning to Extrapolate: A Transductive Approach
2023/04/27 by Aviv Netanyahu, Netanyahu, Aviv, Abhishek Gupta +7 · 1 citation
Computer Science · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and Algorithms #Machine Learning and Data Classification #Topic Modeling
- Finite-Sample Analysis For Decentralized Batch Multi-Agent Reinforcement Learning With Networked Agents
2018/12/06 by Kaiqing Zhang, Zhuoran Yang, Zhang, Kaiqing +7 · 1 citation
Computer Science · Decision Sciences · #Distributed Control Multi-Agent Systems #Game Theory and Applications #Reinforcement Learning in Robotics
- A Finite-Sample Analysis of Payoff-Based Independent Learning in Zero-Sum Stochastic Games
2023/03/03 by Zaiwei Chen, Chen, Zaiwei, Kaiqing Zhang +7 · 1 citation
Decision Sciences · Mathematics · #Advanced Bandit Algorithms Research #Auction Theory and Applications #Computer Science and Game Theory (cs.GT) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Markov Chains and Monte Carlo Methods
- Two-Timescale Q-Learning with Function Approximation in Zero-Sum Stochastic Games
2023/12/08 by Zaiwei Chen, Kaiqing Zhang, Chen, Zaiwei +7 · 1 citation
Computer Science · Decision Sciences · Mathematics · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Markov Chains and Monte Carlo Methods #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics
- First Lasing and Stable Operation of a Direct-Amplification Enabled Harmonic Generation Free-Electron laser
2025/05/18 by Zheng Qi, Junhao Liu, Qi, Zheng +57 · 2 citations
Engineering · Physics and Astronomy · #Accelerator Physics (physics.acc-ph) #Crystallography and Radiation Phenomena #FOS: Physical sciences #Laser-Plasma Interactions and Diagnostics #Particle Accelerators and Free-Electron Lasers
- Biodegradable, Millimeter-Scale Light-Emitting Sensors for Distributed Environmental Monitoring-Functional Pixie Dust
2026/07/20 by Zhiming Hu, Danzhen Zhang, Janghun Ko +24
#physics.app-ph