Zhuoran Yang
- Provably Efficient Reinforcement Learning with Linear Function Approximation
2019/07/11 by Chi Jin, Jin, Chi, Zhuoran Yang +5 · 108 citations
Decision Sciences · Computer Science · Engineering · #Advanced Bandit Algorithms Research #Reinforcement Learning in Robotics #Smart Grid Energy Management
- Multi-Agent Reinforcement Learning: A Selective Overview of Theories and Algorithms
2019/11/24 by Kaiqing Zhang, Zhuoran Yang, Zhang, Kaiqing +3 · 59 citations
Decision Sciences · #Innovation Diffusion and Forecasting
- A Theoretical Analysis of Deep Q-Learning
2019/01/01 by Jianqing Fan, Fan, Jianqing, Zhaoran Wang +5 · 29 citations
Computer Science · Decision Sciences · #Reinforcement Learning in Robotics #Advanced Bandit Algorithms Research #Adversarial Robustness in Machine Learning
- Fully Decentralized Multi-Agent Reinforcement Learning with Networked Agents
2018/02/23 by Kaiqing Zhang, Zhuoran Yang, Zhang, Kaiqing +7 · 23 citations
Computer Science · #Adaptive Dynamic Programming Control #Artificial Intelligence (cs.AI) #Distributed Control Multi-Agent Systems #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Multiagent Systems (cs.MA) #Optimization and Control (math.OC) #Reinforcement Learning in Robotics
- Is Pessimism Provably Efficient for Offline RL?
2020/12/30 by Ying Jin, Jin, Ying, Zhuoran Yang +3 · 29 citations
Computer Science · Decision Sciences · #Reinforcement Learning in Robotics #Advanced Bandit Algorithms Research #Machine Learning and Algorithms
- Pontryagin Differentiable Programming: An End-to-End Learning and Control Framework
2019/12/30 by Wanxin Jin, Jin, Wanxin, Zhaoran Wang +5 · 14 citations
Engineering · Computer Science · #Advanced Control Systems Optimization #Reinforcement Learning in Robotics #Control and Stability of Dynamical Systems
- Diffusion Model is an Effective Planner and Data Synthesizer for Multi-Task Reinforcement Learning
2023/05/29 by Haoran He, He, Haoran, Chenjia Bai +13 · 21 citations
Computer Science · Biochemistry, Genetics and Molecular Biology · #Reinforcement Learning in Robotics #Multimodal Machine Learning Applications #Single-cell and spatial transcriptomics
- A Near-Optimal Algorithm for Stochastic Bilevel Optimization via Double-Momentum
2021/02/15 by Prashant Khanduri, Khanduri, Prashant, Siliang Zeng +9 · 15 citations
Computer Science · Engineering · Medicine · #Stochastic Gradient Optimization Techniques #Sparse and Compressive Sensing Techniques #Pancreatic and Hepatic Oncology Research
- Offline RL with No OOD Actions: In-Sample Learning via Implicit Value Regularization
2023/03/28 by Haoran Xu, Xu, Haoran, Lì Jiāng +11 · 16 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #Data Stream Mining Techniques #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
- Convergent Policy Optimization for Safe Reinforcement Learning
2019/10/26 by Ming Yu, Yu, Ming, Zhuoran Yang +5 · 12 citations
Computer Science · #Adaptive Dynamic Programming Control #Distributed Control Multi-Agent Systems #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics
- Provably Efficient Exploration in Policy Optimization
2019/12/12 by Cai, Qi, Zhuoran Yang, Chi Jin +4 · 8 citations
Computer Science · Decision Sciences · #Reinforcement Learning in Robotics #Advanced Bandit Algorithms Research #Adversarial Robustness in Machine Learning
- Training Dynamics of Multi-Head Softmax Attention for In-Context Learning: Emergence, Convergence, and Optimality
2024/02/29 by Siyu Chen, Chen, Siyu, Heejune Sheen +5 · 13 citations
Computer Science · #Neural Networks and Applications
- Provably Efficient Safe Exploration via Primal-Dual Policy Optimization
2020/03/01 by Dong-Sheng Ding, Ding, Dongsheng, Xiaohan Wei +7 · 8 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Adversarial Robustness in Machine Learning #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Control (math.OC) #Reinforcement Learning in Robotics
- Unveiling Induction Heads: Provable Training Dynamics and Feature Learning in Transformers
2024/09/09 by Siyu Chen, Chen, Siyu, Heejune Sheen +5 · 15 citations
Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Neural Networks and Applications #Optimization and Control (math.OC)
- Neural Certificates for Safe Control Policies
2020/06/15 by Wanxin Jin, Jin, Wanxin, Zhaoran Wang +5 · 8 citations
Engineering · Computer Science · #Fault Detection and Control Systems #Adversarial Robustness in Machine Learning #Reinforcement Learning in Robotics
- Unveil Conditional Diffusion Models with Classifier-free Guidance: A Sharp Statistical Theory
2024/03/18 by Hengyu Fu, Zhuoran Yang, Fu, Hengyu +5 · 11 citations
Physics and Astronomy · #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Statistical Mechanics and Entropy #Statistics Theory (math.ST)
- Enforcing Hard Constraints with Soft Barriers: Safe Reinforcement Learning in Unknown Stochastic Environments
2022/09/29 by Yixuan Wang, Simon Sinong Zhan, Wang, Yixuan +15 · 7 citations
Computer Science · Engineering · #Adversarial Robustness in Machine Learning #Reinforcement Learning in Robotics #Safety Systems Engineering in Autonomy
- The Sample Complexity of Online Contract Design
2022/11/10 by Banghua Zhu, Zhu, Banghua, Stephen Bates +9 · 7 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #Computer Science and Game Theory (cs.GT) #FOS: Computer and information sciences #FOS: Economics and business #Machine Learning (cs.LG) #Machine Learning and Algorithms #Optimization and Search Problems #Theoretical Economics (econ.TH)
- Reinforcement Learning with Human Feedback: Learning Dynamic Choices via Pessimism
2023/05/29 by Zihao Li, Zhuoran Yang, Li, Zihao +3 · 8 citations
Computer Science · Energy · Engineering · #Artificial Intelligence (cs.AI) #Energy, Environment, and Transportation Policies #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Control (math.OC) #Reinforcement Learning in Robotics #Smart Grid Energy Management #Statistics Theory (math.ST)
- Neural Temporal-Difference and Q-Learning Provably Converge to Global Optima
2019/05/24 by Cai, Qi, Zhuoran Yang, Jason D. Lee +4 · 8 citations
Computer Science · #Reinforcement Learning in Robotics #Adaptive Dynamic Programming Control #Machine Learning and ELM
- Human-in-the-loop: Provably Efficient Preference-based Reinforcement Learning with General Function Approximation
2022/05/23 by Xiaoyu Chen, Chen, Xiaoyu, Han Zhong +7 · 6 citations
Computer Science · Engineering · #Reinforcement Learning in Robotics #Transportation and Mobility Innovations
- Reflective Planning: Vision-Language Models for Multi-Stage Long-Horizon Robotic Manipulation
2025/02/23 by Yunhai Feng, Feng, Yunhai, Jiaming Han +9 · 16 citations
Computer Science · #Robotic Path Planning Algorithms
- Policy learning "without" overlap: Pessimism and generalized empirical Bernstein's inequality
2022/12/19 by Ying Jin, Jin, Ying, Zhimei Ren +5 · 5 citations
Computer Science · Engineering · #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #Methodology (stat.ME) #Statistics Theory (math.ST) #Water Systems and Optimization #Water resources management and optimization
- Online Bootstrap Inference For Policy Evaluation in Reinforcement Learning
2021/08/08 by Pratik Ramprasad, Ramprasad, Pratik, Yuantong Li +9 · 4 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Advanced Multi-Objective Optimization Algorithms #Artificial Intelligence (cs.AI) #Distributed Sensor Networks and Detection Algorithms #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Statistics Theory (math.ST)
- Unlocking Out-of-Distribution Generalization in Transformers via Recursive Latent Space Reasoning
2025/10/15 by Awni Altabaa, Altabaa, Awni, Siyu Chen +5 · 1 voice · 2 citations
#cs.LG #cs.AI
- Actor-Critic Provably Finds Nash Equilibria of Linear-Quadratic Mean-Field Games
2019/10/16 by Zuyue Fu, Zhuoran Yang, Fu, Zuyue +5 · 5 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Computer Science and Game Theory (cs.GT) #FOS: Computer and information sciences #FOS: Mathematics #Game Theory and Applications #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Multiagent Systems (cs.MA) #Optimization and Control (math.OC) #Reinforcement Learning in Robotics
- Single-Timescale Stochastic Nonconvex-Concave Optimization for Smooth Nonlinear TD Learning
2020/08/23 by Shuang Qiu, Qiu, Shuang, Zhuoran Yang +7 · 4 citations
Computer Science · Decision Sciences · #Stochastic Gradient Optimization Techniques #Advanced Bandit Algorithms Research #Reinforcement Learning in Robotics
- Unveiling the Statistical Foundations of Chain-of-Thought Prompting Methods
2024/08/25 by Xinyang Hu, Hu, Xinyang, Fengzhuo Zhang +5 · 5 citations
Computer Science · Psychology · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #Data Visualization and Analytics #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Mental Health Research Topics #Statistics Theory (math.ST)
- STRIDE: A Tool-Assisted LLM Agent Framework for Strategic and Interactive Decision-Making
2024/05/25 by Chuanhao Li, Li, Chuanhao, Runhan Yang +11 · 4 citations
Computer Science · #Multi-Agent Systems and Negotiation #Digital Rights Management and Security
- Dynamic Regret of Policy Optimization in Non-stationary Environments
2020/06/30 by Yingjie Fei, Zhuoran Yang, Fei, Yingjie +5 · 2 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Control (math.OC) #Optimization and Search Problems #Reinforcement Learning in Robotics
- Error Analyses of Auto-Regressive Video Diffusion Models: A Unified Framework
2025/03/12 by Jing Wang, Fengzhuo Zhang, Wang, Jing +13 · 7 citations
Computer Science · #Image and Video Quality Assessment #Video Coding and Compression Technologies #Visual Attention and Saliency Detection
- Instrumental Variable Value Iteration for Causal Offline Reinforcement Learning
2021/02/19 by Luofeng Liao, Zuyue Fu, Liao, Luofeng +8 · 2 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Adversarial Robustness in Machine Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics
- Pessimism in the Face of Confounders: Provably Efficient Offline Reinforcement Learning in Partially Observable Markov Decision Processes
2022/05/26 by Miao Lu, Lu, Miao, Yifei Min +5 · 2 citations
Computer Science · #Artificial Intelligence (cs.AI) #Distributed Sensor Networks and Detection Algorithms #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #Methodology (stat.ME) #Reinforcement Learning in Robotics #Statistics Theory (math.ST)
- Breaking the Curse of Many Agents: Provable Mean Embedding Q-Iteration\n for Mean-Field Reinforcement Learning
2020/06/21 by Lingxiao Wang, Zhuoran Yang, Wang, Lingxiao +3 · 2 citations
Computer Science · #Reinforcement Learning in Robotics #Evolutionary Algorithms and Applications #Metaheuristic Optimization Algorithms Research
- Muon Outperforms Adam in Tail-End Associative Memory Learning
2025/09/30 by Shuche Wang, Fengzhuo Zhang, Wang, Shuche +17 · 1 voice · 7 citations
Engineering · Physics and Astronomy · #Muon and positron interactions and applications #Particle Detector Development and Performance #Particle physics theoretical and experimental studies #cs.AI #cs.LG #math.OC
- Decentralized Multi-Agent Reinforcement Learning with Networked Agents: Recent Advances
2019/12/09 by Kaiqing Zhang, Zhang, Kaiqing, Zhuoran Yang +3 · 3 citations
Computer Science · #Distributed Control Multi-Agent Systems #Reinforcement Learning in Robotics #Age of Information Optimization
- A Communication-Efficient Multi-Agent Actor-Critic Algorithm for Distributed Reinforcement Learning
2019/07/06 by Yixuan Lin, Kaiqing Zhang, Lin, Yixuan +11 · 1 citation
Computer Science · #Adaptive Dynamic Programming Control #Distributed Control Multi-Agent Systems #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics
- On Computation and Generalization of Generative Adversarial Imitation Learning
2020/01/09 by Minshuo Chen, Chen, Minshuo, Yizhou Wang +11 · 1 citation
Computer Science · #Reinforcement Learning in Robotics #Machine Learning and Algorithms #Adversarial Robustness in Machine Learning
- Provably Efficient Neural Estimation of Structural Equation Model: An Adversarial Approach
2020/07/02 by Luofeng Liao, You-Lin Chen, Liao, Luofeng +9 · 1 citation
Computer Science · Physics and Astronomy · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and ELM #Model Reduction and Neural Networks #Neural Networks and Applications
- On the Global Optimality of Model-Agnostic Meta-Learning
2020/06/23 by Lingxiao Wang, Wang, Lingxiao, Zhuoran Yang +4 · 1 citation
Computer Science · Environmental Science · #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Groundwater flow and contamination studies #Machine Learning (cs.LG) #Machine Learning (stat.ML)
- Pysical Informed Driving World Model
2024/12/11 by Zhuoran Yang, Yang, Zhuoran, Xi Guo +7 · 3 citations
Engineering · #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Traffic Prediction and Management Techniques
- Doubly Robust Off-Policy Actor-Critic: Convergence and Optimality
2021/02/23 by Tengyu Xu, Zhuoran Yang, Xu, Tengyu +5 · 1 citation
Computer Science · #Adaptive Dynamic Programming Control #Adversarial Robustness in Machine Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics
- From Words to Actions: Unveiling the Theoretical Underpinnings of LLM-Driven Autonomous Systems
2024/05/30 by Jianliang He, He, Jianliang, Siyu Chen +5 · 2 citations
Computer Science · Business, Management and Accounting · #Semantic Web and Ontologies #Business Process Modeling and Analysis #Multi-Agent Systems and Negotiation
- Exponential Family Model-Based Reinforcement Learning via Score Matching
2021/12/28 by Gene Li, Li, Gene, Junbo Li +8 · 1 citation
Decision Sciences · Computer Science · Economics, Econometrics and Finance · #Advanced Bandit Algorithms Research #Reinforcement Learning in Robotics #Sports Analytics and Performance
- Pessimism meets VCG: Learning Dynamic Mechanism Design via Offline Reinforcement Learning
2022/05/05 by Boxiang Lyu, Lyu, Boxiang, Zhaoran Wang +5 · 1 citation
Business, Management and Accounting · Computer Science · Decision Sciences · #Auction Theory and Applications #Computer Science and Game Theory (cs.GT) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Supply Chain and Inventory Management
- Decentralized Optimistic Hyperpolicy Mirror Descent: Provably No-Regret Learning in Markov Games
2022/06/03 by Wenhao Zhan, Jason D. Lee, Zhan, Wenhao +3 · 1 citation
Computer Science · Decision Sciences · Engineering · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Smart Grid Energy Management
- Embed to Control Partially Observed Systems: Representation Learning with Provable Sample Efficiency
2022/05/26 by Lingxiao Wang, Cai Qi, Wang, Lingxiao +5 · 1 citation
Computer Science · #Adversarial Robustness in Machine Learning #Reinforcement Learning in Robotics
- BanditSpec: Adaptive Speculative Decoding via Bandit Algorithms
2025/05/21 by Y. R. Hou, Hou, Yunlong, Fengzhuo Zhang +14 · 4 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #Data Stream Mining Techniques #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
- Finding Regularized Competitive Equilibria of Heterogeneous Agent Macroeconomic Models with Reinforcement Learning
2023/02/24 by Ruitu Xu, Yifei Min, Xu, Ruitu +9 · 1 citation
Business, Management and Accounting · Economics, Econometrics and Finance · #Complex Systems and Time Series Analysis #Economic theories and models #FOS: Computer and information sciences #FOS: Economics and business #Financial Literacy, Pension, Retirement Analysis #General Economics (econ.GN) #Machine Learning (cs.LG)
- On Stein's Identity and Near-Optimal Estimation in High-dimensional Index Models
2017/09/26 by Zhuoran Yang, Yang, Zhuoran, Krishnakumar Balasubramanian +3 · 1 citation
Mathematics · #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (stat.ML) #Methodology (stat.ME) #Random Matrices and Applications #Statistical Methods and Bayesian Inference #Statistical Methods and Inference #Statistics Theory (math.ST)
- Double Duality: Variational Primal-Dual Policy Optimization for Constrained Reinforcement Learning
2024/02/16 by Zihao Li, Li, Zihao, Boyi Liu +7 · 1 citation
Computer Science · #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Control (math.OC) #Reinforcement Learning in Robotics
- Sample-Efficient Multi-Agent RL: An Optimization Perspective
2023/10/10 by Nuoya Xiong, Zhihan Liu, Xiong, Nuoya +5 · 1 citation
Computer Science · Decision Sciences · #Reinforcement Learning in Robotics #Advanced Bandit Algorithms Research
- Offline Reinforcement Learning with Instrumental Variables in Confounded Markov Decision Processes
2022/09/18 by Zuyue Fu, Fu, Zuyue, Zhengling Qi +9 · 1 citation
Computer Science · #Age of Information Optimization #FOS: Computer and information sciences #Machine Learning (cs.LG) #Methodology (stat.ME)
- Symmetric Mean-field Langevin Dynamics for Distributional Minimax Problems
2023/12/02 by Juno Kim, Kakei Yamamoto, Kim, Juno +7 · 1 citation
Computer Science · Mathematics · #FOS: Computer and information sciences #FOS: Mathematics #Gaussian Processes and Bayesian Inference #Machine Learning (stat.ML) #Markov Chains and Monte Carlo Methods #Optimization and Control (math.OC) #Stochastic Gradient Optimization Techniques
- A Mean-Field Analysis of Neural Stochastic Gradient Descent-Ascent for Functional Minimax Optimization
2024/04/18 by Yuchen Zhu, Zhu, Yuchen, Yufeng Zhang +6 · 1 citation
Physics and Astronomy · #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Model Reduction and Neural Networks #Optimization and Control (math.OC)
- Finite-Sample Analysis For Decentralized Batch Multi-Agent Reinforcement Learning With Networked Agents
2018/12/06 by Kaiqing Zhang, Zhuoran Yang, Zhang, Kaiqing +7 · 1 citation
Computer Science · Decision Sciences · #Distributed Control Multi-Agent Systems #Game Theory and Applications #Reinforcement Learning in Robotics
- A Reinforcement Learning Approach in Multi-Phase Second-Price Auction Design
2022/10/19 by Rui Ai, Boxiang Lyu, Ai, Rui +7 · 1 citation
Decision Sciences · Engineering · #Auction Theory and Applications #Advanced Bandit Algorithms Research #Smart Grid Energy Management
- A Convergence Result for Regularized Actor-Critic Methods
2019/07/13 by Wesley A. Suttle, Suttle, Wesley, Zhuoran Yang +5 · 1 citation
Computer Science · Decision Sciences · Economics, Econometrics and Finance · #Economic theories and models #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Risk and Portfolio Optimization
- Sample-Efficient Reinforcement Learning from Human Feedback via Information-Directed Sampling
2025/02/08 by Qi Han, Haochen Yang, Qi, Han +5 · 1 citation
Computer Science · #Reinforcement Learning in Robotics #Distributed Sensor Networks and Detection Algorithms #Neural Networks and Applications
- Towards General Function Approximation in Zero-Sum Markov Games
2021/07/30 by Baihe Huang, Jason D. Lee, Huang, Baihe +5 · 2 citations
Computer Science · Decision Sciences · Mathematics · #Reinforcement Learning in Robotics #Advanced Bandit Algorithms Research #Markov Chains and Monte Carlo Methods
- Supervised Fine-Tuning vs. In-Context Learning: An Equilibrium Analysis of LLM Personalization under Congestion
2026/07/15 by Fengzhuo Zhang, Zhuoran Yang, Dirk Bergemann
#cs.LG #econ.TH #stat.ML