Dongbin Zhao
- StarCraft Micromanagement with Reinforcement Learning and Curriculum Transfer Learning
2018/04/03 by Kun Shao, Shao, Kun, Yuanheng Zhu +3 · 1 voice · 1 citation
Computer Science · Psychology · Social Sciences · #Artificial Intelligence in Games #Artificial intelligence #Artificial neural network #Class (philosophy) #Competitive learning #Computer science #Curriculum #Digital Games and Media #Function (biology) #Machine learning #Psychology #Reinforcement Learning in Robotics #Reinforcement learning #Scale (ratio) #Transfer of learning #cs.AI #cs.LG #cs.MA
- ConRFT: A Reinforced Fine-tuning Method for VLA Models via Consistency Policy
2025/02/08 by Yuhui Chen, Chen, Yuhui, Tian, Shuai +7 · 60 citations
Engineering · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Robotics (cs.RO) #Traffic Prediction and Management Techniques
- A Survey of Deep Reinforcement Learning in Video Games
2019/12/23 by Kun Shao, Shao, Kun, Zhentao Tang +7 · 14 citations
Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Artificial Intelligence in Games #Reinforcement Learning in Robotics #cs.AI #cs.LG #cs.MA
- RoboGPT: an intelligent agent of making embodied long-term decisions for daily instruction tasks
2023/11/27 by Yaran Chen, Chen, Yaran, Wenbo Cui +11 · 13 citations
Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multimodal Machine Learning Applications #Natural Language Processing Techniques #Robotics (cs.RO) #Topic Modeling
- Lane Change Decision-making through Deep Reinforcement Learning with Rule-based Constraints
2019/03/30 by Junjie Wang, Wang, Junjie, Qichao Zhang +5 · 7 citations
Computer Science · Engineering · Mathematics · #Artificial Intelligence (cs.AI) #Autonomous Vehicle Technology and Safety #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Robotics (cs.RO) #Traffic control and management #cs.AI #cs.LG #cs.RO #stat.ML
- Boosting Continuous Control with Consistency Policy
2023/10/10 by Yuhui Chen, Chen, Yuhui, Haoran Li +3 · 1 voice · 12 citations
Computer Science · #FOS: Computer and information sciences #Machine Learning (cs.LG) #cs.LG
- SRFT: A Single-Stage Method with Supervised and Reinforcement Fine-Tuning for Reasoning
2025/06/24 by Yuqian Fu, Tinghong Chen, Fu, Yuqian +17 · 37 citations
Computer Science · #Logic, programming, and type systems #Logic, Reasoning, and Knowledge #Intelligent Tutoring Systems and Adaptive Learning
- STEPS: Joint Self-supervised Nighttime Image Enhancement and Depth Estimation
2023/02/02 by Yupeng Zheng, Chengliang Zhong, Zheng, Yupeng +19 · 8 citations
Computer Science · Engineering · #Advanced Vision and Imaging #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Image Enhancement Techniques #Image Processing Techniques and Applications
- Learning When to Think: Shaping Adaptive Reasoning in R1-Style Models via Multi-Stage RL
2025/05/16 by Songjun Tu, Tu, Songjun, Jiahao Lin +11 · 32 citations
Computer Science · #Topic Modeling #Data Stream Mining Techniques #Machine Learning and Data Classification
- PlanAgent: A Multi-modal Large Language Agent for Closed-loop Vehicle Motion Planning
2024/06/03 by Yupeng Zheng, Zebin Xing, Zheng, Yupeng +19 · 12 citations
Computer Science · #FOS: Computer and information sciences #Natural Language Processing Techniques #Robotics (cs.RO)
- TrajGen: Generating Realistic and Diverse Trajectories with Reactive and Feasible Agent Behaviors for Autonomous Driving
2022/03/31 by Qichao Zhang, Yinfeng Gao, Zhang, Qichao +13 · 5 citations
Engineering · #Artificial Intelligence (cs.AI) #Autonomous Vehicle Technology and Safety #FOS: Computer and information sciences #Robotics (cs.RO) #Traffic and Road Safety #Traffic control and management
- Data Scaling Laws for Imitation Learning-Based End-to-End Autonomous Driving
2024/12/03 by Yupeng Zheng, Zheng, Yupeng, Pengxuan Yang +22 · 1 voice · 9 citations
Computer Science · Engineering · #Autonomous Vehicle Technology and Safety #FOS: Computer and information sciences #Robotics (cs.RO) #cs.RO
- Enhancing LLM Reasoning with Iterative DPO: A Comprehensive Empirical Investigation
2025/03/17 by Songjun Tu, Tu, Songjun, J. C. Lin +18 · 16 citations
Computer Science · #Computation and Language (cs.CL) #FOS: Computer and information sciences #Natural Language Processing Techniques
- Event-Triggered Multi-agent Reinforcement Learning with Communication under Limited-bandwidth Constraint
2020/10/10 by Guangzheng Hu, Hu, Guangzheng, Yuanheng Zhu +7 · 2 citations
Computer Science · #Adaptive Dynamic Programming Control #Distributed Control Multi-Agent Systems #Reinforcement Learning in Robotics #cs.MA
- Heuristic Rank Selection with Progressively Searching Tensor Ring Network
2020/09/22 by Nannan Li, Li, Nannan, Yu Pan +9 · 2 citations
Computer Science · Mathematics · #Advanced Neural Network Applications #Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Machine Learning and ELM #Tensor decomposition and applications #cs.AI #cs.CV
- Meta-DT: Offline Meta-RL as Conditional Sequence Modeling with World Model Disentanglement
2024/10/15 by Z.J. Wang, Wang, Zhi, Li Zhang +9 · 5 citations
Engineering · Decision Sciences · #Advanced Data Processing Techniques #Simulation Techniques and Applications #Scientific Computing and Data Management
- A Hierarchical Deep Reinforcement Learning Framework for 6-DOF UCAV Air-to-Air Combat
2022/12/05 by Jiajun Chai, Chai, Jiajun, Wenzhang Chen +7 · 2 citations
Engineering · #Aerospace and Aviation Technology #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #FOS: Electrical engineering #Guidance and Control Systems #Systems and Control (eess.SY) #electronic engineering #information engineering
- Discretizing Continuous Action Space with Unimodal Probability Distributions for On-Policy Reinforcement Learning
2024/08/01 by Yuanyang Zhu, Zhu, Yuanyang, Zhi Wang +7 · 3 citations
Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
- UncAD: Towards Safe End-to-end Autonomous Driving via Online Map Uncertainty
2025/04/17 by Yang, Pengxuan, Yupeng Zheng, Qichao Zhang +13 · 7 citations
Computer Science · Engineering · #Autonomous Vehicle Technology and Safety #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Robotic Path Planning Algorithms #Robotics (cs.RO) #Robotics and Sensor-Based Localization
- RLAE: Reinforcement Learning-Assisted Ensemble for LLMs
2025/05/31 by Yuqian Fu, Yuanheng Zhu, Fu, Yuqian +11 · 6 citations
Computer Science · #Artificial Intelligence (cs.AI) #Digital Rights Management and Security #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multi-Agent Systems and Negotiation #Semantic Web and Ontologies
- Dynamic Horizon Value Estimation for Model-based Reinforcement Learning
2020/09/21 by Junjie Wang, Wang, Junjie, Qichao Zhang +7 · 1 citation
Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #cs.AI #cs.LG
- BiFNet: Bidirectional Fusion Network for Road Segmentation
2020/04/18 by Haoran Li, Yaran Chen, Li, Haoran +5 · 1 citation
Computer Science · Engineering · Environmental Science · #Advanced Neural Network Applications #Autonomous Vehicle Technology and Safety #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Remote Sensing and LiDAR Applications #cs.CV
- World4RL: Diffusion World Models for Policy Refinement with Reinforcement Learning for Robotic Manipulation
2025/09/23 by Ziyuan Jiang, Kai Liu, Jiang, Zhennan +15 · 6 citations
Computer Science · Engineering · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Generative Adversarial Networks and Image Synthesis #Reinforcement Learning in Robotics #Robot Manipulation and Learning #Robotics (cs.RO)
- SELU: Self-Learning Embodied MLLMs in Unknown Environments
2024/10/04 by Boyu Li, Li, Boyu, Jiang, Haobin +10 · 3 citations
Computer Science · #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Natural Language Processing Techniques #Speech and dialogue systems
- Generalizing Consistency Policy to Visual RL with Prioritized Proximal Experience Regularization
2024/09/28 by Haoran Li, Li, Haoran, Ziyuan Jiang +5 · 3 citations
Computer Science · #Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Online Learning and Analytics
- Survey of Vision-Language-Action Models for Embodied Manipulation
2025/08/21 by Haoran Li, Li, Haoran, Yu‐Hui Chen +13 · 5 citations
Computer Science · Psychology · #Multimodal Machine Learning Applications #Reinforcement Learning in Robotics #Social Robot Interaction and HRI
- Learning Future Representation with Synthetic Observations for Sample-efficient Reinforcement Learning
2024/05/20 by Xin Liu, Liu, Xin, Yaran Chen +3 · 2 citations
Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Gaussian Processes and Bayesian Inference #Machine Learning (cs.LG)
- Revisiting On-Policy Distillation: Empirical Failure Modes and Simple Fixes
2026/03/26 by Yuqian Fu, Haohuan Huang, Kaiwen Jiang +4 · 1 voice · 3 citations
Computer Science · #cs.AI #cs.CL #cs.LG
- Cross-domain Random Pre-training with Prototypes for Reinforcement Learning
2023/02/11 by Xin Liu, Liu, Xin, Yaran Chen +7 · 1 citation
Computer Science · #Artificial Intelligence (cs.AI) #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Neural Networks and Reservoir Computing
- TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning
2025/05/26 by Yuhui Chen, Chen, Yuhui, Haoran Li +7 · 3 citations
Computer Science · #Reinforcement Learning in Robotics
- MemChain: Learning Interpretable Memory Traces for Memory-Augmented LLM Agents
2026/07/27 by Yiwen Ma, Songjun Tu, Qichao Zhang +3
Computer Science · #cs.AI