vix.ing · top · new · best · stats · spec

Zhuoran Yang

  1. Provably Efficient Reinforcement Learning with Linear Function Approximation
    2019/07/11 by Chi Jin, Jin, Chi, Zhuoran Yang +5 · 108 citations
    Decision Sciences · Computer Science · Engineering · #Advanced Bandit Algorithms Research #Reinforcement Learning in Robotics #Smart Grid Energy Management
  2. Multi-Agent Reinforcement Learning: A Selective Overview of Theories and Algorithms
    2019/11/24 by Kaiqing Zhang, Zhuoran Yang, Zhang, Kaiqing +3 · 59 citations
    Decision Sciences · #Innovation Diffusion and Forecasting
  3. A Theoretical Analysis of Deep Q-Learning
    2019/01/01 by Jianqing Fan, Fan, Jianqing, Zhaoran Wang +5 · 29 citations
    Computer Science · Decision Sciences · #Reinforcement Learning in Robotics #Advanced Bandit Algorithms Research #Adversarial Robustness in Machine Learning
  4. Fully Decentralized Multi-Agent Reinforcement Learning with Networked Agents
    2018/02/23 by Kaiqing Zhang, Zhuoran Yang, Zhang, Kaiqing +7 · 23 citations
    Computer Science · #Adaptive Dynamic Programming Control #Artificial Intelligence (cs.AI) #Distributed Control Multi-Agent Systems #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Multiagent Systems (cs.MA) #Optimization and Control (math.OC) #Reinforcement Learning in Robotics
  5. Is Pessimism Provably Efficient for Offline RL?
    2020/12/30 by Ying Jin, Jin, Ying, Zhuoran Yang +3 · 29 citations
    Computer Science · Decision Sciences · #Reinforcement Learning in Robotics #Advanced Bandit Algorithms Research #Machine Learning and Algorithms
  6. Pontryagin Differentiable Programming: An End-to-End Learning and Control Framework
    2019/12/30 by Wanxin Jin, Jin, Wanxin, Zhaoran Wang +5 · 14 citations
    Engineering · Computer Science · #Advanced Control Systems Optimization #Reinforcement Learning in Robotics #Control and Stability of Dynamical Systems
  7. Diffusion Model is an Effective Planner and Data Synthesizer for Multi-Task Reinforcement Learning
    2023/05/29 by Haoran He, He, Haoran, Chenjia Bai +13 · 21 citations
    Computer Science · Biochemistry, Genetics and Molecular Biology · #Reinforcement Learning in Robotics #Multimodal Machine Learning Applications #Single-cell and spatial transcriptomics
  8. A Near-Optimal Algorithm for Stochastic Bilevel Optimization via Double-Momentum
    2021/02/15 by Prashant Khanduri, Khanduri, Prashant, Siliang Zeng +9 · 15 citations
    Computer Science · Engineering · Medicine · #Stochastic Gradient Optimization Techniques #Sparse and Compressive Sensing Techniques #Pancreatic and Hepatic Oncology Research
  9. Offline RL with No OOD Actions: In-Sample Learning via Implicit Value Regularization
    2023/03/28 by Haoran Xu, Xu, Haoran, Lì Jiāng +11 · 16 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #Data Stream Mining Techniques #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
  10. Convergent Policy Optimization for Safe Reinforcement Learning
    2019/10/26 by Ming Yu, Yu, Ming, Zhuoran Yang +5 · 12 citations
    Computer Science · #Adaptive Dynamic Programming Control #Distributed Control Multi-Agent Systems #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics
  11. Provably Efficient Exploration in Policy Optimization
    2019/12/12 by Cai, Qi, Zhuoran Yang, Chi Jin +4 · 8 citations
    Computer Science · Decision Sciences · #Reinforcement Learning in Robotics #Advanced Bandit Algorithms Research #Adversarial Robustness in Machine Learning
  12. Training Dynamics of Multi-Head Softmax Attention for In-Context Learning: Emergence, Convergence, and Optimality
    2024/02/29 by Siyu Chen, Chen, Siyu, Heejune Sheen +5 · 13 citations
    Computer Science · #Neural Networks and Applications
  13. Provably Efficient Safe Exploration via Primal-Dual Policy Optimization
    2020/03/01 by Dong-Sheng Ding, Ding, Dongsheng, Xiaohan Wei +7 · 8 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Adversarial Robustness in Machine Learning #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Control (math.OC) #Reinforcement Learning in Robotics
  14. Unveiling Induction Heads: Provable Training Dynamics and Feature Learning in Transformers
    2024/09/09 by Siyu Chen, Chen, Siyu, Heejune Sheen +5 · 15 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Neural Networks and Applications #Optimization and Control (math.OC)
  15. Neural Certificates for Safe Control Policies
    2020/06/15 by Wanxin Jin, Jin, Wanxin, Zhaoran Wang +5 · 8 citations
    Engineering · Computer Science · #Fault Detection and Control Systems #Adversarial Robustness in Machine Learning #Reinforcement Learning in Robotics
  16. Unveil Conditional Diffusion Models with Classifier-free Guidance: A Sharp Statistical Theory
    2024/03/18 by Hengyu Fu, Zhuoran Yang, Fu, Hengyu +5 · 11 citations
    Physics and Astronomy · #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Statistical Mechanics and Entropy #Statistics Theory (math.ST)
  17. Enforcing Hard Constraints with Soft Barriers: Safe Reinforcement Learning in Unknown Stochastic Environments
    2022/09/29 by Yixuan Wang, Simon Sinong Zhan, Wang, Yixuan +15 · 7 citations
    Computer Science · Engineering · #Adversarial Robustness in Machine Learning #Reinforcement Learning in Robotics #Safety Systems Engineering in Autonomy
  18. The Sample Complexity of Online Contract Design
    2022/11/10 by Banghua Zhu, Zhu, Banghua, Stephen Bates +9 · 7 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #Computer Science and Game Theory (cs.GT) #FOS: Computer and information sciences #FOS: Economics and business #Machine Learning (cs.LG) #Machine Learning and Algorithms #Optimization and Search Problems #Theoretical Economics (econ.TH)
  19. Reinforcement Learning with Human Feedback: Learning Dynamic Choices via Pessimism
    2023/05/29 by Zihao Li, Zhuoran Yang, Li, Zihao +3 · 8 citations
    Computer Science · Energy · Engineering · #Artificial Intelligence (cs.AI) #Energy, Environment, and Transportation Policies #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Control (math.OC) #Reinforcement Learning in Robotics #Smart Grid Energy Management #Statistics Theory (math.ST)
  20. Neural Temporal-Difference and Q-Learning Provably Converge to Global Optima
    2019/05/24 by Cai, Qi, Zhuoran Yang, Jason D. Lee +4 · 8 citations
    Computer Science · #Reinforcement Learning in Robotics #Adaptive Dynamic Programming Control #Machine Learning and ELM
  21. Human-in-the-loop: Provably Efficient Preference-based Reinforcement Learning with General Function Approximation
    2022/05/23 by Xiaoyu Chen, Chen, Xiaoyu, Han Zhong +7 · 6 citations
    Computer Science · Engineering · #Reinforcement Learning in Robotics #Transportation and Mobility Innovations
  22. Reflective Planning: Vision-Language Models for Multi-Stage Long-Horizon Robotic Manipulation
    2025/02/23 by Yunhai Feng, Feng, Yunhai, Jiaming Han +9 · 16 citations
    Computer Science · #Robotic Path Planning Algorithms
  23. Policy learning "without" overlap: Pessimism and generalized empirical Bernstein's inequality
    2022/12/19 by Ying Jin, Jin, Ying, Zhimei Ren +5 · 5 citations
    Computer Science · Engineering · #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #Methodology (stat.ME) #Statistics Theory (math.ST) #Water Systems and Optimization #Water resources management and optimization
  24. Online Bootstrap Inference For Policy Evaluation in Reinforcement Learning
    2021/08/08 by Pratik Ramprasad, Ramprasad, Pratik, Yuantong Li +9 · 4 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Advanced Multi-Objective Optimization Algorithms #Artificial Intelligence (cs.AI) #Distributed Sensor Networks and Detection Algorithms #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Statistics Theory (math.ST)
  25. Unlocking Out-of-Distribution Generalization in Transformers via Recursive Latent Space Reasoning
    2025/10/15 by Awni Altabaa, Altabaa, Awni, Siyu Chen +5 · 1 voice · 2 citations
    #cs.LG #cs.AI
  26. Actor-Critic Provably Finds Nash Equilibria of Linear-Quadratic Mean-Field Games
    2019/10/16 by Zuyue Fu, Zhuoran Yang, Fu, Zuyue +5 · 5 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Computer Science and Game Theory (cs.GT) #FOS: Computer and information sciences #FOS: Mathematics #Game Theory and Applications #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Multiagent Systems (cs.MA) #Optimization and Control (math.OC) #Reinforcement Learning in Robotics
  27. Single-Timescale Stochastic Nonconvex-Concave Optimization for Smooth Nonlinear TD Learning
    2020/08/23 by Shuang Qiu, Qiu, Shuang, Zhuoran Yang +7 · 4 citations
    Computer Science · Decision Sciences · #Stochastic Gradient Optimization Techniques #Advanced Bandit Algorithms Research #Reinforcement Learning in Robotics
  28. Unveiling the Statistical Foundations of Chain-of-Thought Prompting Methods
    2024/08/25 by Xinyang Hu, Hu, Xinyang, Fengzhuo Zhang +5 · 5 citations
    Computer Science · Psychology · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #Data Visualization and Analytics #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Mental Health Research Topics #Statistics Theory (math.ST)
  29. STRIDE: A Tool-Assisted LLM Agent Framework for Strategic and Interactive Decision-Making
    2024/05/25 by Chuanhao Li, Li, Chuanhao, Runhan Yang +11 · 4 citations
    Computer Science · #Multi-Agent Systems and Negotiation #Digital Rights Management and Security
  30. Dynamic Regret of Policy Optimization in Non-stationary Environments
    2020/06/30 by Yingjie Fei, Zhuoran Yang, Fei, Yingjie +5 · 2 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Control (math.OC) #Optimization and Search Problems #Reinforcement Learning in Robotics
  31. Error Analyses of Auto-Regressive Video Diffusion Models: A Unified Framework
    2025/03/12 by Jing Wang, Fengzhuo Zhang, Wang, Jing +13 · 7 citations
    Computer Science · #Image and Video Quality Assessment #Video Coding and Compression Technologies #Visual Attention and Saliency Detection
  32. Instrumental Variable Value Iteration for Causal Offline Reinforcement Learning
    2021/02/19 by Luofeng Liao, Zuyue Fu, Liao, Luofeng +8 · 2 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Adversarial Robustness in Machine Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics
  33. Pessimism in the Face of Confounders: Provably Efficient Offline Reinforcement Learning in Partially Observable Markov Decision Processes
    2022/05/26 by Miao Lu, Lu, Miao, Yifei Min +5 · 2 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Distributed Sensor Networks and Detection Algorithms #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #Methodology (stat.ME) #Reinforcement Learning in Robotics #Statistics Theory (math.ST)
  34. Breaking the Curse of Many Agents: Provable Mean Embedding Q-Iteration\n for Mean-Field Reinforcement Learning
    2020/06/21 by Lingxiao Wang, Zhuoran Yang, Wang, Lingxiao +3 · 2 citations
    Computer Science · #Reinforcement Learning in Robotics #Evolutionary Algorithms and Applications #Metaheuristic Optimization Algorithms Research
  35. Muon Outperforms Adam in Tail-End Associative Memory Learning
    2025/09/30 by Shuche Wang, Fengzhuo Zhang, Wang, Shuche +17 · 1 voice · 7 citations
    Engineering · Physics and Astronomy · #Muon and positron interactions and applications #Particle Detector Development and Performance #Particle physics theoretical and experimental studies #cs.AI #cs.LG #math.OC
  36. Decentralized Multi-Agent Reinforcement Learning with Networked Agents: Recent Advances
    2019/12/09 by Kaiqing Zhang, Zhang, Kaiqing, Zhuoran Yang +3 · 3 citations
    Computer Science · #Distributed Control Multi-Agent Systems #Reinforcement Learning in Robotics #Age of Information Optimization
  37. A Communication-Efficient Multi-Agent Actor-Critic Algorithm for Distributed Reinforcement Learning
    2019/07/06 by Yixuan Lin, Kaiqing Zhang, Lin, Yixuan +11 · 1 citation
    Computer Science · #Adaptive Dynamic Programming Control #Distributed Control Multi-Agent Systems #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics
  38. On Computation and Generalization of Generative Adversarial Imitation Learning
    2020/01/09 by Minshuo Chen, Chen, Minshuo, Yizhou Wang +11 · 1 citation
    Computer Science · #Reinforcement Learning in Robotics #Machine Learning and Algorithms #Adversarial Robustness in Machine Learning
  39. Provably Efficient Neural Estimation of Structural Equation Model: An Adversarial Approach
    2020/07/02 by Luofeng Liao, You-Lin Chen, Liao, Luofeng +9 · 1 citation
    Computer Science · Physics and Astronomy · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and ELM #Model Reduction and Neural Networks #Neural Networks and Applications
  40. On the Global Optimality of Model-Agnostic Meta-Learning
    2020/06/23 by Lingxiao Wang, Wang, Lingxiao, Zhuoran Yang +4 · 1 citation
    Computer Science · Environmental Science · #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Groundwater flow and contamination studies #Machine Learning (cs.LG) #Machine Learning (stat.ML)
  41. Pysical Informed Driving World Model
    2024/12/11 by Zhuoran Yang, Yang, Zhuoran, Xi Guo +7 · 3 citations
    Engineering · #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Traffic Prediction and Management Techniques
  42. Doubly Robust Off-Policy Actor-Critic: Convergence and Optimality
    2021/02/23 by Tengyu Xu, Zhuoran Yang, Xu, Tengyu +5 · 1 citation
    Computer Science · #Adaptive Dynamic Programming Control #Adversarial Robustness in Machine Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics
  43. From Words to Actions: Unveiling the Theoretical Underpinnings of LLM-Driven Autonomous Systems
    2024/05/30 by Jianliang He, He, Jianliang, Siyu Chen +5 · 2 citations
    Computer Science · Business, Management and Accounting · #Semantic Web and Ontologies #Business Process Modeling and Analysis #Multi-Agent Systems and Negotiation
  44. Exponential Family Model-Based Reinforcement Learning via Score Matching
    2021/12/28 by Gene Li, Li, Gene, Junbo Li +8 · 1 citation
    Decision Sciences · Computer Science · Economics, Econometrics and Finance · #Advanced Bandit Algorithms Research #Reinforcement Learning in Robotics #Sports Analytics and Performance
  45. Pessimism meets VCG: Learning Dynamic Mechanism Design via Offline Reinforcement Learning
    2022/05/05 by Boxiang Lyu, Lyu, Boxiang, Zhaoran Wang +5 · 1 citation
    Business, Management and Accounting · Computer Science · Decision Sciences · #Auction Theory and Applications #Computer Science and Game Theory (cs.GT) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Supply Chain and Inventory Management
  46. Decentralized Optimistic Hyperpolicy Mirror Descent: Provably No-Regret Learning in Markov Games
    2022/06/03 by Wenhao Zhan, Jason D. Lee, Zhan, Wenhao +3 · 1 citation
    Computer Science · Decision Sciences · Engineering · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Smart Grid Energy Management
  47. Embed to Control Partially Observed Systems: Representation Learning with Provable Sample Efficiency
    2022/05/26 by Lingxiao Wang, Cai Qi, Wang, Lingxiao +5 · 1 citation
    Computer Science · #Adversarial Robustness in Machine Learning #Reinforcement Learning in Robotics
  48. BanditSpec: Adaptive Speculative Decoding via Bandit Algorithms
    2025/05/21 by Y. R. Hou, Hou, Yunlong, Fengzhuo Zhang +14 · 4 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #Data Stream Mining Techniques #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
  49. Finding Regularized Competitive Equilibria of Heterogeneous Agent Macroeconomic Models with Reinforcement Learning
    2023/02/24 by Ruitu Xu, Yifei Min, Xu, Ruitu +9 · 1 citation
    Business, Management and Accounting · Economics, Econometrics and Finance · #Complex Systems and Time Series Analysis #Economic theories and models #FOS: Computer and information sciences #FOS: Economics and business #Financial Literacy, Pension, Retirement Analysis #General Economics (econ.GN) #Machine Learning (cs.LG)
  50. On Stein's Identity and Near-Optimal Estimation in High-dimensional Index Models
    2017/09/26 by Zhuoran Yang, Yang, Zhuoran, Krishnakumar Balasubramanian +3 · 1 citation
    Mathematics · #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (stat.ML) #Methodology (stat.ME) #Random Matrices and Applications #Statistical Methods and Bayesian Inference #Statistical Methods and Inference #Statistics Theory (math.ST)
  51. Double Duality: Variational Primal-Dual Policy Optimization for Constrained Reinforcement Learning
    2024/02/16 by Zihao Li, Li, Zihao, Boyi Liu +7 · 1 citation
    Computer Science · #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Control (math.OC) #Reinforcement Learning in Robotics
  52. Sample-Efficient Multi-Agent RL: An Optimization Perspective
    2023/10/10 by Nuoya Xiong, Zhihan Liu, Xiong, Nuoya +5 · 1 citation
    Computer Science · Decision Sciences · #Reinforcement Learning in Robotics #Advanced Bandit Algorithms Research
  53. Offline Reinforcement Learning with Instrumental Variables in Confounded Markov Decision Processes
    2022/09/18 by Zuyue Fu, Fu, Zuyue, Zhengling Qi +9 · 1 citation
    Computer Science · #Age of Information Optimization #FOS: Computer and information sciences #Machine Learning (cs.LG) #Methodology (stat.ME)
  54. Symmetric Mean-field Langevin Dynamics for Distributional Minimax Problems
    2023/12/02 by Juno Kim, Kakei Yamamoto, Kim, Juno +7 · 1 citation
    Computer Science · Mathematics · #FOS: Computer and information sciences #FOS: Mathematics #Gaussian Processes and Bayesian Inference #Machine Learning (stat.ML) #Markov Chains and Monte Carlo Methods #Optimization and Control (math.OC) #Stochastic Gradient Optimization Techniques
  55. A Mean-Field Analysis of Neural Stochastic Gradient Descent-Ascent for Functional Minimax Optimization
    2024/04/18 by Yuchen Zhu, Zhu, Yuchen, Yufeng Zhang +6 · 1 citation
    Physics and Astronomy · #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Model Reduction and Neural Networks #Optimization and Control (math.OC)
  56. Finite-Sample Analysis For Decentralized Batch Multi-Agent Reinforcement Learning With Networked Agents
    2018/12/06 by Kaiqing Zhang, Zhuoran Yang, Zhang, Kaiqing +7 · 1 citation
    Computer Science · Decision Sciences · #Distributed Control Multi-Agent Systems #Game Theory and Applications #Reinforcement Learning in Robotics
  57. A Reinforcement Learning Approach in Multi-Phase Second-Price Auction Design
    2022/10/19 by Rui Ai, Boxiang Lyu, Ai, Rui +7 · 1 citation
    Decision Sciences · Engineering · #Auction Theory and Applications #Advanced Bandit Algorithms Research #Smart Grid Energy Management
  58. A Convergence Result for Regularized Actor-Critic Methods
    2019/07/13 by Wesley A. Suttle, Suttle, Wesley, Zhuoran Yang +5 · 1 citation
    Computer Science · Decision Sciences · Economics, Econometrics and Finance · #Economic theories and models #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Risk and Portfolio Optimization
  59. Sample-Efficient Reinforcement Learning from Human Feedback via Information-Directed Sampling
    2025/02/08 by Qi Han, Haochen Yang, Qi, Han +5 · 1 citation
    Computer Science · #Reinforcement Learning in Robotics #Distributed Sensor Networks and Detection Algorithms #Neural Networks and Applications
  60. Towards General Function Approximation in Zero-Sum Markov Games
    2021/07/30 by Baihe Huang, Jason D. Lee, Huang, Baihe +5 · 2 citations
    Computer Science · Decision Sciences · Mathematics · #Reinforcement Learning in Robotics #Advanced Bandit Algorithms Research #Markov Chains and Monte Carlo Methods
  61. Supervised Fine-Tuning vs. In-Context Learning: An Equilibrium Analysis of LLM Personalization under Congestion
    2026/07/15 by Fengzhuo Zhang, Zhuoran Yang, Dirk Bergemann
    #cs.LG #econ.TH #stat.ML