vix.ing · top · new · best · stats · spec

Dongbin Zhao

  1. StarCraft Micromanagement with Reinforcement Learning and Curriculum Transfer Learning
    2018/04/03 by Kun Shao, Shao, Kun, Yuanheng Zhu +3 · 1 voice · 1 citation
    Computer Science · Psychology · Social Sciences · #Artificial Intelligence in Games #Artificial intelligence #Artificial neural network #Class (philosophy) #Competitive learning #Computer science #Curriculum #Digital Games and Media #Function (biology) #Machine learning #Psychology #Reinforcement Learning in Robotics #Reinforcement learning #Scale (ratio) #Transfer of learning #cs.AI #cs.LG #cs.MA
  2. ConRFT: A Reinforced Fine-tuning Method for VLA Models via Consistency Policy
    2025/02/08 by Yuhui Chen, Chen, Yuhui, Tian, Shuai +7 · 60 citations
    Engineering · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Robotics (cs.RO) #Traffic Prediction and Management Techniques
  3. A Survey of Deep Reinforcement Learning in Video Games
    2019/12/23 by Kun Shao, Shao, Kun, Zhentao Tang +7 · 14 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Artificial Intelligence in Games #Reinforcement Learning in Robotics #cs.AI #cs.LG #cs.MA
  4. RoboGPT: an intelligent agent of making embodied long-term decisions for daily instruction tasks
    2023/11/27 by Yaran Chen, Chen, Yaran, Wenbo Cui +11 · 13 citations
    Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multimodal Machine Learning Applications #Natural Language Processing Techniques #Robotics (cs.RO) #Topic Modeling
  5. Lane Change Decision-making through Deep Reinforcement Learning with Rule-based Constraints
    2019/03/30 by Junjie Wang, Wang, Junjie, Qichao Zhang +5 · 7 citations
    Computer Science · Engineering · Mathematics · #Artificial Intelligence (cs.AI) #Autonomous Vehicle Technology and Safety #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Robotics (cs.RO) #Traffic control and management #cs.AI #cs.LG #cs.RO #stat.ML
  6. Boosting Continuous Control with Consistency Policy
    2023/10/10 by Yuhui Chen, Chen, Yuhui, Haoran Li +3 · 1 voice · 12 citations
    Computer Science · #FOS: Computer and information sciences #Machine Learning (cs.LG) #cs.LG
  7. SRFT: A Single-Stage Method with Supervised and Reinforcement Fine-Tuning for Reasoning
    2025/06/24 by Yuqian Fu, Tinghong Chen, Fu, Yuqian +17 · 37 citations
    Computer Science · #Logic, programming, and type systems #Logic, Reasoning, and Knowledge #Intelligent Tutoring Systems and Adaptive Learning
  8. STEPS: Joint Self-supervised Nighttime Image Enhancement and Depth Estimation
    2023/02/02 by Yupeng Zheng, Chengliang Zhong, Zheng, Yupeng +19 · 8 citations
    Computer Science · Engineering · #Advanced Vision and Imaging #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Image Enhancement Techniques #Image Processing Techniques and Applications
  9. Learning When to Think: Shaping Adaptive Reasoning in R1-Style Models via Multi-Stage RL
    2025/05/16 by Songjun Tu, Tu, Songjun, Jiahao Lin +11 · 32 citations
    Computer Science · #Topic Modeling #Data Stream Mining Techniques #Machine Learning and Data Classification
  10. PlanAgent: A Multi-modal Large Language Agent for Closed-loop Vehicle Motion Planning
    2024/06/03 by Yupeng Zheng, Zebin Xing, Zheng, Yupeng +19 · 12 citations
    Computer Science · #FOS: Computer and information sciences #Natural Language Processing Techniques #Robotics (cs.RO)
  11. TrajGen: Generating Realistic and Diverse Trajectories with Reactive and Feasible Agent Behaviors for Autonomous Driving
    2022/03/31 by Qichao Zhang, Yinfeng Gao, Zhang, Qichao +13 · 5 citations
    Engineering · #Artificial Intelligence (cs.AI) #Autonomous Vehicle Technology and Safety #FOS: Computer and information sciences #Robotics (cs.RO) #Traffic and Road Safety #Traffic control and management
  12. Data Scaling Laws for Imitation Learning-Based End-to-End Autonomous Driving
    2024/12/03 by Yupeng Zheng, Zheng, Yupeng, Pengxuan Yang +22 · 1 voice · 9 citations
    Computer Science · Engineering · #Autonomous Vehicle Technology and Safety #FOS: Computer and information sciences #Robotics (cs.RO) #cs.RO
  13. Enhancing LLM Reasoning with Iterative DPO: A Comprehensive Empirical Investigation
    2025/03/17 by Songjun Tu, Tu, Songjun, J. C. Lin +18 · 16 citations
    Computer Science · #Computation and Language (cs.CL) #FOS: Computer and information sciences #Natural Language Processing Techniques
  14. Event-Triggered Multi-agent Reinforcement Learning with Communication under Limited-bandwidth Constraint
    2020/10/10 by Guangzheng Hu, Hu, Guangzheng, Yuanheng Zhu +7 · 2 citations
    Computer Science · #Adaptive Dynamic Programming Control #Distributed Control Multi-Agent Systems #Reinforcement Learning in Robotics #cs.MA
  15. Heuristic Rank Selection with Progressively Searching Tensor Ring Network
    2020/09/22 by Nannan Li, Li, Nannan, Yu Pan +9 · 2 citations
    Computer Science · Mathematics · #Advanced Neural Network Applications #Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Machine Learning and ELM #Tensor decomposition and applications #cs.AI #cs.CV
  16. Meta-DT: Offline Meta-RL as Conditional Sequence Modeling with World Model Disentanglement
    2024/10/15 by Z.J. Wang, Wang, Zhi, Li Zhang +9 · 5 citations
    Engineering · Decision Sciences · #Advanced Data Processing Techniques #Simulation Techniques and Applications #Scientific Computing and Data Management
  17. A Hierarchical Deep Reinforcement Learning Framework for 6-DOF UCAV Air-to-Air Combat
    2022/12/05 by Jiajun Chai, Chai, Jiajun, Wenzhang Chen +7 · 2 citations
    Engineering · #Aerospace and Aviation Technology #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #FOS: Electrical engineering #Guidance and Control Systems #Systems and Control (eess.SY) #electronic engineering #information engineering
  18. Discretizing Continuous Action Space with Unimodal Probability Distributions for On-Policy Reinforcement Learning
    2024/08/01 by Yuanyang Zhu, Zhu, Yuanyang, Zhi Wang +7 · 3 citations
    Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
  19. UncAD: Towards Safe End-to-end Autonomous Driving via Online Map Uncertainty
    2025/04/17 by Yang, Pengxuan, Yupeng Zheng, Qichao Zhang +13 · 7 citations
    Computer Science · Engineering · #Autonomous Vehicle Technology and Safety #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Robotic Path Planning Algorithms #Robotics (cs.RO) #Robotics and Sensor-Based Localization
  20. RLAE: Reinforcement Learning-Assisted Ensemble for LLMs
    2025/05/31 by Yuqian Fu, Yuanheng Zhu, Fu, Yuqian +11 · 6 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Digital Rights Management and Security #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multi-Agent Systems and Negotiation #Semantic Web and Ontologies
  21. Dynamic Horizon Value Estimation for Model-based Reinforcement Learning
    2020/09/21 by Junjie Wang, Wang, Junjie, Qichao Zhang +7 · 1 citation
    Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #cs.AI #cs.LG
  22. BiFNet: Bidirectional Fusion Network for Road Segmentation
    2020/04/18 by Haoran Li, Yaran Chen, Li, Haoran +5 · 1 citation
    Computer Science · Engineering · Environmental Science · #Advanced Neural Network Applications #Autonomous Vehicle Technology and Safety #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Remote Sensing and LiDAR Applications #cs.CV
  23. World4RL: Diffusion World Models for Policy Refinement with Reinforcement Learning for Robotic Manipulation
    2025/09/23 by Ziyuan Jiang, Kai Liu, Jiang, Zhennan +15 · 6 citations
    Computer Science · Engineering · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Generative Adversarial Networks and Image Synthesis #Reinforcement Learning in Robotics #Robot Manipulation and Learning #Robotics (cs.RO)
  24. SELU: Self-Learning Embodied MLLMs in Unknown Environments
    2024/10/04 by Boyu Li, Li, Boyu, Jiang, Haobin +10 · 3 citations
    Computer Science · #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Natural Language Processing Techniques #Speech and dialogue systems
  25. Generalizing Consistency Policy to Visual RL with Prioritized Proximal Experience Regularization
    2024/09/28 by Haoran Li, Li, Haoran, Ziyuan Jiang +5 · 3 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Online Learning and Analytics
  26. Survey of Vision-Language-Action Models for Embodied Manipulation
    2025/08/21 by Haoran Li, Li, Haoran, Yu‐Hui Chen +13 · 5 citations
    Computer Science · Psychology · #Multimodal Machine Learning Applications #Reinforcement Learning in Robotics #Social Robot Interaction and HRI
  27. Learning Future Representation with Synthetic Observations for Sample-efficient Reinforcement Learning
    2024/05/20 by Xin Liu, Liu, Xin, Yaran Chen +3 · 2 citations
    Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Gaussian Processes and Bayesian Inference #Machine Learning (cs.LG)
  28. Revisiting On-Policy Distillation: Empirical Failure Modes and Simple Fixes
    2026/03/26 by Yuqian Fu, Haohuan Huang, Kaiwen Jiang +4 · 1 voice · 3 citations
    Computer Science · #cs.AI #cs.CL #cs.LG
  29. Cross-domain Random Pre-training with Prototypes for Reinforcement Learning
    2023/02/11 by Xin Liu, Liu, Xin, Yaran Chen +7 · 1 citation
    Computer Science · #Artificial Intelligence (cs.AI) #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Neural Networks and Reservoir Computing
  30. TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning
    2025/05/26 by Yuhui Chen, Chen, Yuhui, Haoran Li +7 · 3 citations
    Computer Science · #Reinforcement Learning in Robotics
  31. MemChain: Learning Interpretable Memory Traces for Memory-Augmented LLM Agents
    2026/07/27 by Yiwen Ma, Songjun Tu, Qichao Zhang +3
    Computer Science · #cs.AI