Yaodong Yang
- Multi-Agent Reinforcement Learning is a Sequence Modeling Problem
2022/05/30 by Muning Wen, Wen, Muning, Jakub Grudzien Kuba +11 · 2 voices · 29 citations
#cs.MA #cs.LG
- Multiagent Bidirectionally-Coordinated Nets: Emergence of Human-level Coordination in Learning to Play StarCraft Combat Games
2017/03/29 by Peng Peng, Peng, Peng, Ying Wen +11 · 2 voices · 23 citations
Computer Science · #Adversarial Robustness in Machine Learning #Artificial Intelligence in Games #Reinforcement Learning in Robotics #cs.AI #cs.LG
- Safe RLHF: Safe Reinforcement Learning from Human Feedback
2023/10/19 by Josef Dai, Dai, Josef, Xuehai Pan +13 · 122 citations
Computer Science · #Software Engineering Research #Explainable Artificial Intelligence (XAI) #Topic Modeling
- Mean Field Multi-Agent Reinforcement Learning
2018/02/15 by Yaodong Yang, Rui Luo, Yang, Yaodong +9 · 26 citations
Computer Science · Decision Sciences · Physics and Astronomy · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Game Theory and Applications #Machine Learning (cs.LG) #Multiagent Systems (cs.MA) #Opinion Dynamics and Social Influence #Reinforcement Learning in Robotics
- UniDexGrasp++: Improving Dexterous Grasping Policy Learning via Geometry-aware Curriculum and Iterative Generalist-Specialist Learning
2023/04/02 by Weikang Wan, Wan, Weikang, Haoran Geng +11 · 30 citations
Computer Science · Engineering · #Human Pose and Action Recognition #Robot Manipulation and Learning #Hand Gesture Recognition Systems
- JARVIS-1: Open-World Multi-task Agents with Memory-Augmented Multimodal Language Models
2023/11/10 by Zihao Wang, Shaofei Cai, Wang, Zihao +21 · 28 citations
Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Multimodal Machine Learning Applications #Natural Language Processing Techniques #Topic Modeling
- ProAgent: Building Proactive Cooperative Agents with Large Language Models
2023/08/22 by Ceyao Zhang, Kaijie Yang, Zhang, Ceyao +27 · 25 citations
Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multiagent Systems (cs.MA) #Topic Modeling
- Heterogeneous-Agent Reinforcement Learning
2023/04/19 by Yifan Zhong, Zhong, Yifan, Jakub Grudzien Kuba +8 · 20 citations
Computer Science · #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Mobile Crowdsensing and Crowdsourcing #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics
- Safety-Gymnasium: A Unified Safe Reinforcement Learning Benchmark
2023/10/19 by Jiaming Ji, Ji, Jiaming, Borong Zhang +17 · 22 citations
Computer Science · Engineering · #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #Autonomous Vehicle Technology and Safety #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
- GenDexGrasp: Generalizable Dexterous Grasping
2022/10/03 by Puhao Li, Li, Puhao, Tengyu Liu +11 · 15 citations
Computer Science · Engineering · #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Hand Gesture Recognition Systems #Human Pose and Action Recognition #Robot Manipulation and Learning #Robotics (cs.RO)
- Probabilistic Recursive Reasoning for Multi-Agent Reinforcement Learning
2019/01/26 by Ying Wen, Wen, Ying, Yaodong Yang +7 · 11 citations
Computer Science · Decision Sciences · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Game Theory and Applications #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics
- SafeDreamer: Safe Reinforcement Learning with World Models
2023/07/14 by Weidong Huang, Jiaming Ji, Huang, Weidong +7 · 11 citations
Computer Science · #Adversarial Robustness in Machine Learning #Anomaly Detection Techniques and Applications #Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
- Object-Centric Dexterous Manipulation from Human Motion Data
2024/11/06 by Yuanpei Chen, Chen, Yuanpei, Chen Wang +5 · 19 citations
Computer Science · Engineering · #Advanced Vision and Imaging #FOS: Computer and information sciences #Robot Manipulation and Learning #Robotic Mechanisms and Dynamics #Robotics (cs.RO)
- Efficient Ridesharing Order Dispatching with Mean Field Multi-Agent Reinforcement Learning
2019/01/31 by Minne Li, Li, Minne, Qin Qin +16 · 6 citations
Business, Management and Accounting · Engineering · #FOS: Computer and information sciences #Multiagent Systems (cs.MA) #Sharing Economy and Platforms #Smart Parking Systems Research #Transportation and Mobility Innovations
- OmniSafe: An Infrastructure for Accelerating Safe Reinforcement Learning Research
2023/05/16 by Jiaming Ji, Ji, Jiaming, Jiayi Zhou +17 · 9 citations
Computer Science · Social Sciences · Health Professions · #Adversarial Robustness in Machine Learning #Ethics and Social Impacts of AI #Occupational Health and Safety Research
- A Survey on Vision-Language-Action Models: An Action Tokenization Perspective
2025/07/02 by Yifan Zhong, Zhong, Yifan, Bai, Fengshuo +23 · 36 citations
Computer Science · Social Sciences · #Ethics and Social Impacts of AI #FOS: Computer and information sciences #Multimodal Machine Learning Applications #Robotics (cs.RO) #Topic Modeling
- SMARTS: Scalable Multi-Agent Reinforcement Learning Training School for Autonomous Driving
2020/10/19 by Ming Zhou, Zhou, Ming, Jun Luo +68 · 12 citations
Computer Science · Engineering · #Reinforcement Learning in Robotics #Autonomous Vehicle Technology and Safety #Transportation and Mobility Innovations
- A Comprehensive Survey in LLM(-Agent) Full Stack Safety: Data, Training and Deployment
2025/04/22 by Kun Wang, Guibin Zhang, Wang, Kun +193 · 33 citations
Computer Science · Health Professions · Medicine · #Adversarial Robustness in Machine Learning #Occupational Health and Safety Research #Artificial Intelligence in Healthcare and Education
- Multi-Agent Constrained Policy Optimisation
2021/10/06 by Shangding Gu, Jakub Grudzien Kuba, Gu, Shangding +13 · 6 citations
Computer Science · Engineering · #Reinforcement Learning in Robotics #Autonomous Vehicle Technology and Safety #Robot Manipulation and Learning
- Dynamic Handover: Throw and Catch with Bimanual Hands
2023/09/11 by Binghao Huang, Yuanpei Chen, Huang, Binghao +11 · 8 citations
Computer Science · Engineering · #FOS: Computer and information sciences #Human Pose and Action Recognition #Machine Learning (cs.LG) #Reinforcement Learning in Robotics #Robot Manipulation and Learning #Robotics (cs.RO)
- SafeSora: Towards Safety Alignment of Text2Video Generation via a Human Preference Dataset
2024/06/20 by Josef Dai, Dai, Josef, Xuyao Wang +10 · 8 citations
Computer Science · #Advanced Text Analysis Techniques #Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #Databases (cs.DB) #FOS: Computer and information sciences #Natural Language Processing Techniques #Topic Modeling
- SafeVLA: Towards Safety Alignment of Vision-Language-Action Model via Constrained Learning
2025/03/05 by Borong Zhang, Yuhao Zhang, Zhang, Borong +10 · 13 citations
Computer Science · #Multimodal Machine Learning Applications #Human Pose and Action Recognition
- Constrained Update Projection Approach to Safe Policy Optimization
2022/09/15 by Yang Long, Yang, Long, Jiaming Ji +13 · 4 citations
Computer Science · #Reinforcement Learning in Robotics #Software Reliability and Analysis Research
- Align Anything: Training All-Modality Models to Follow Instructions with Language Feedback
2024/12/20 by Jiaming Ji, Jiayi Zhou, Ji, Jiaming +34 · 10 citations
Computer Science · #Intelligent Tutoring Systems and Adaptive Learning #Speech and dialogue systems #Natural Language Processing Techniques
- CivRealm: A Learning and Reasoning Odyssey in Civilization for Decision-Making Agents
2024/01/19 by Siyuan Qi, Shuo Chen, Qi, Siyuan +25 · 6 citations
Computer Science · #Artificial Intelligence (cs.AI) #Artificial Intelligence in Games #FOS: Computer and information sciences #Multi-Agent Systems and Negotiation #Topic Modeling
- Amulet: ReAlignment During Test Time for Personalized Preference Adaptation of LLMs
2025/02/26 by Zhaowei Zhang, Zhang, Zhaowei, Fengshuo Bai +13 · 11 citations
Computer Science · #Computation and Language (cs.CL) #FOS: Computer and information sciences #I.2.7 #Machine Learning (cs.LG) #Natural Language Processing Techniques #Text Readability and Simplification #Topic Modeling
- In-Context Editing: Learning Knowledge from Self-Induced Distributions
2024/06/17 by Siyuan Qi, Bangcheng Yang, Qi, Siyuan +13 · 6 citations
Computer Science · #Computation and Language (cs.CL) #Data Stream Mining Techniques #FOS: Computer and information sciences #Machine Learning and Algorithms
- PHYBench: Holistic Evaluation of Physical Perception and Reasoning in Large Language Models
2025/04/22 by Shi Qiu, Qiu, Shi, Shaoyang Guo +98 · 14 citations
Computer Science · #Computation and Language (cs.CL) #Explainable Artificial Intelligence (XAI) #FOS: Computer and information sciences #Online Learning and Analytics #Topic Modeling
- Maximum Entropy Heterogeneous-Agent Reinforcement Learning
2023/06/19 by Jiarong Liu, Liu, Jiarong, Yifan Zhong +11 · 4 citations
Computer Science · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multiagent Systems (cs.MA) #Neural Networks and Applications #Reinforcement Learning in Robotics
- RedStar: Does Scaling Long-CoT Data Unlock Better Slow-Reasoning Systems?
2025/01/20 by Haotian Xu, Xing Wu, Xu, Haotian +25 · 10 citations
Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #Explainable Artificial Intelligence (XAI) #FOS: Computer and information sciences #Machine Learning (cs.LG)
- Byzantine Robust Cooperative Multi-Agent Reinforcement Learning as a Bayesian Game
2023/05/22 by Simin Li, Li, Simin, Jun Guo +13 · 5 citations
Computer Science · #Adversarial Robustness in Machine Learning #Computer Science and Game Theory (cs.GT) #FOS: Computer and information sciences #Reinforcement Learning in Robotics
- AnySkill: Learning Open-Vocabulary Physical Skill for Interactive Agents
2024/03/19 by Jieming Cui, Tengyu Liu, Cui, Jieming +9 · 5 citations
Computer Science · #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Natural Language Processing Techniques #Robotics (cs.RO) #Text Readability and Simplification
- ASP: Learn a Universal Neural Solver!
2023/03/01 by Chenguang Wang, Zhouliang Yu, Wang, Chenguang +7 · 3 citations
Computer Science · Engineering · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning and Algorithms #Metaheuristic Optimization Algorithms Research #Optimization and Control (math.OC) #Vehicle Routing Optimization Methods
- Learning to Shape Rewards using a Game of Two Partners
2021/03/16 by David Mguni, Taher Jafferjee, Mguni, David +19 · 2 citations
Computer Science · Decision Sciences · #Reinforcement Learning in Robotics #Advanced Bandit Algorithms Research #Data Stream Mining Techniques
- Game-Theoretic Multiagent Reinforcement Learning
2020/11/01 by Yaodong Yang, Yang, Yaodong, Ma, Chengdong +5 · 3 citations
Computer Science · Economics, Econometrics and Finance · #Artificial Intelligence (cs.AI) #Artificial Intelligence in Games #FOS: Computer and information sciences #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics #Sports Analytics and Performance
- A Perspective of Q-value Estimation on Offline-to-Online Reinforcement Learning
2023/12/12 by Yinmin Zhang, Jie Liu, Zhang, Yinmin +11 · 3 citations
Computer Science · #Reinforcement Learning in Robotics
- Efficient Model-agnostic Alignment via Bayesian Persuasion
2024/05/29 by Fengshuo Bai, Bai, Fengshuo, Mingzhi Wang +11 · 4 citations
Computer Science · #Bayesian Modeling and Causal Inference #Gaussian Processes and Bayesian Inference #Machine Learning and Data Classification
- Offline Pre-trained Multi-Agent Decision Transformer: One Big Sequence Model Tackles All SMAC Tasks
2021/12/06 by Linghui Meng, Meng, Linghui, Muning Wen +17 · 2 citations
Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics
- Roadmap on Incentive Compatibility for AI Alignment and Governance in Sociotechnical Systems
2024/02/20 by Zhaowei Zhang, Zhang, Zhaowei, Fengshuo Bai +9 · 3 citations
Business, Management and Accounting · Economics, Econometrics and Finance · Engineering · #Advanced Research in Systems and Signal Processing #Artificial Intelligence (cs.AI) #Computer Science and Game Theory (cs.GT) #Computers and Society (cs.CY) #Economic Development and Digital Transformation #Economic and Technological Systems Analysis #FOS: Computer and information sciences #Human-Computer Interaction (cs.HC) #I.2.m #K.4.m
- ACE: Cooperative Multi-agent Q-learning with Bidirectional Action-Dependency
2022/11/29 by Chuming Li, Jie Liu, Li, Chuming +13 · 2 citations
Computer Science · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics
- Efficient Preference-based Reinforcement Learning via Aligned Experience Estimation
2024/05/29 by Fengshuo Bai, Bai, Fengshuo, Rui Zhao +13 · 4 citations
Engineering · Computer Science · #Smart Grid Energy Management #Data Stream Mining Techniques #Anomaly Detection Techniques and Applications
- Large Sequence Models for Sequential Decision-Making: A Survey
2023/06/24 by Muning Wen, Runji Lin, Wen, Muning +15 · 2 citations
Computer Science · #Artificial Intelligence (cs.AI) #Explainable Artificial Intelligence (XAI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and Data Classification #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics
- RAT: Adversarial Attacks on Deep Reinforcement Agents for Targeted Behaviors
2024/12/14 by Fengshuo Bai, Bai, Fengshuo, Runze Liu +7 · 4 citations
Computer Science · #Adversarial Robustness in Machine Learning
- Diverse Auto-Curriculum is Critical for Successful Real-World Multiagent\n Learning Systems
2021/02/15 by Yaodong Yang, Jun Luo, Yang, Yaodong +13 · 1 citation
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #Data Stream Mining Techniques #FOS: Computer and information sciences #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics
- Efficient Adaptation in Mixed-Motive Environments via Hierarchical Opponent Modeling and Planning
2024/06/12 by Yizhe Huang, Huang, Yizhe, Anji Liu +9 · 3 citations
Computer Science · #Artificial Intelligence (cs.AI) #Data Visualization and Analytics #FOS: Computer and information sciences #Multiagent Systems (cs.MA)
- Modelling Behavioural Diversity for Learning in Open-Ended Games
2021/03/14 by Nicolas Perez Nieves, Yaodong Yang, Nieves, Nicolas Perez +9 · 1 citation
Computer Science · Decision Sciences · #Artificial Intelligence (cs.AI) #Computer Science and Game Theory (cs.GT) #FOS: Computer and information sciences #Game Theory and Applications #Intelligent Tutoring Systems and Adaptive Learning #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics
- Learning in Nonzero-Sum Stochastic Games with Potentials
2021/03/16 by David Mguni, Yutong Wu, Mguni, David +15 · 2 citations
Computer Science · Decision Sciences · #Reinforcement Learning in Robotics #Auction Theory and Applications #Game Theory and Applications
- Cooperative Multi-Agent Transfer Learning with Level-Adaptive Credit Assignment
2021/06/01 by Tianze Zhou, Zhou, Tianze, Fubiao Zhang +23 · 1 citation
Computer Science · #Artificial Intelligence (cs.AI) #Artificial Intelligence in Games #FOS: Computer and information sciences #Multimodal Machine Learning Applications #Reinforcement Learning in Robotics
- Is Nash Equilibrium Approximator Learnable?
2021/08/17 by Zhijian Duan, Wenhan Huang, Duan, Zhijian +11 · 1 citation
Decision Sciences · Social Sciences · #Advanced Bandit Algorithms Research #Computer Science and Game Theory (cs.GT) #Experimental Behavioral Economics Studies #FOS: Computer and information sciences #Game Theory and Applications #Machine Learning (cs.LG) #Multiagent Systems (cs.MA)
- RobustVLA: On Robustness of Vision-Language-Action Model against Multi-Modal Perturbations
2025/09/26 by Jianing Guo, Zhenhong Wu, Guo, Jianing +29 · 4 citations
#cs.CV #cs.AI #cs.RO
- Magnetic Preference Optimization: Achieving Last-iterate Convergence for Language Model Alignment
2024/10/22 by Mingzhi Wang, Chengdong Ma, Wang, Mingzhi +17 · 2 citations
Computer Science · #Computation and Language (cs.CL) #FOS: Computer and information sciences #Natural Language Processing Techniques #Speech and dialogue systems #Topic Modeling
- JiangJun: Mastering Xiangqi by Tackling Non-Transitivity in Two-Player Zero-Sum Games
2023/08/09 by Yang Li, Li, Yang, Kun Xiong +15 · 1 citation
Computer Science · Economics, Econometrics and Finance · Psychology · #Artificial Intelligence (cs.AI) #Artificial Intelligence in Games #FOS: Computer and information sciences #Gambling Behavior and Treatments #Sports Analytics and Performance
- Can Deep Learning Predict Risky Retail Investors? A Case Study in Financial Risk Behavior Forecasting
2018/12/14 by Yaodong Yang, Alisa Kolesnikova, Yang, Yaodong +9 · 1 citation
Decision Sciences · Economics, Econometrics and Finance · Engineering · #Stock Market Forecasting Methods #Financial Markets and Investment Strategies #Energy Load and Power Forecasting
- Regret-Minimizing Double Oracle for Extensive-Form Games
2023/04/20 by Xiaohang Tang, Tang, Xiaohang, Le Cong Dinh +5 · 1 citation
Decision Sciences · Computer Science · Psychology · #Advanced Bandit Algorithms Research #Artificial Intelligence in Games #Gambling Behavior and Treatments
- A Game-Theoretic Negotiation Framework for Cross-Cultural Consensus in LLMs
2025/06/16 by Guoxi Zhang, Jiawei Chen, Zhang, Guoxi +8 · 1 citation
Business, Management and Accounting · #Outsourcing and Supply Chain Management
- Adaptive Visuo-Tactile Fusion with Predictive Force Attention for Dexterous Manipulation
2025/05/20 by Jinzhou Li, Tianhao Wu, Li, Jinzhou +14 · 2 citations
Computer Science · Engineering · Neuroscience · #FOS: Computer and information sciences #Robotics (cs.RO) #Tactile and Sensory Interactions #Teleoperation and Haptic Systems #Virtual Reality Applications and Impacts
- Generative RLHF-V: Learning Principles from Multi-modal Human Preference
2025/05/24 by Jiayi Zhou, Jiaming Ji, Zhou, Jiayi +14 · 2 citations
Computer Science · #Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Natural Language Processing Techniques #Speech and dialogue systems
- PILA: Plug-and-Play Insertion for LLM-native Advertising
2026/07/28 by Zhaowei Zhang, Yuhan Fu, Yihang Zhang +6 · 1 citation
#cs.CL