Chenjun Xiao
- Kimi k1.5: Scaling Reinforcement Learning with LLMs
2025/01/22 by Kimi Team, Angang Du, Du, Angang +173 · 5 voices · 299 citations
Engineering · Computer Science · #Robot Manipulation and Learning #Machine Learning and Data Classification #Machine Learning and Algorithms
- Kimi K2: Open Agentic Intelligence
2025/07/28 by Yifan Bai, Kimi Team, Bai, Yifan +363 · 6 voices · 85 citations
Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Machine Learning (cs.LG) #cs.AI #cs.CL #cs.LG
- On the Global Convergence Rates of Softmax Policy Gradient Methods
2020/05/13 by Jincheng Mei, Chenjun Xiao, Mei, Jincheng +5 · 25 citations
Computer Science · Decision Sciences · #Stochastic Gradient Optimization Techniques #Reinforcement Learning in Robotics #Advanced Bandit Algorithms Research
- On the Optimality of Batch Policy Optimization Algorithms
2021/04/06 by Chenjun Xiao, Xiao, Chenjun, Yifan Wu +13 · 2 citations
Computer Science · Engineering · #Advanced Manufacturing and Logistics Optimization #FOS: Computer and information sciences #Machine Learning (cs.LG) #Optimization and Search Problems #Scheduling and Optimization Algorithms
- Diffusion Spectral Representation for Reinforcement Learning
2024/06/23 by Dmitry Shribak, Chen-Xiao Gao, Shribak, Dmitry +7 · 3 citations
Computer Science · #Reinforcement Learning in Robotics
- Iteratively Refined Behavior Regularization for Offline Reinforcement Learning
2023/06/09 by Xiaohan Hu, Hu, Xiaohan, Yi Ma +6 · 2 citations
Computer Science · #Artificial Intelligence (cs.AI) #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and Data Classification #Reinforcement Learning in Robotics
- Conditionally Optimistic Exploration for Cooperative Deep Multi-Agent Reinforcement Learning
2023/03/16 by Xutong Zhao, Yangchen Pan, Zhao, Xutong +7 · 1 citation
Computer Science · #Adversarial Robustness in Machine Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics
- Behavior-Regularized Diffusion Policy Optimization for Offline Reinforcement Learning
2025/02/07 by Chen-Xiao Gao, Chenyang Wu, Gao, Chen-Xiao +9 · 2 citations
Computer Science · Engineering · #Artificial Intelligence (cs.AI) #Elevator Systems and Control #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics #Traffic control and management
- The In-Sample Softmax for Offline Reinforcement Learning
2023/02/28 by Chenjun Xiao, Xiao, Chenjun, Han Wang +7 · 1 citation
Computer Science · #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #Data Stream Mining Techniques #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
- Hindsight Preference Learning for Offline Preference-based Reinforcement Learning
2024/07/05 by Chen-Xiao Gao, Gao, Chen-Xiao, Shengjun Fang +7 · 1 citation
Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Fuzzy Logic and Control Systems #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
- An MRP Formulation for Supervised Learning: Generalized Temporal Difference Learning Models
2024/04/23 by Yangchen Pan, Junfeng Wen, Pan, Yangchen +5 · 1 citation
Computer Science · #Speech Recognition and Synthesis
- Latent Variable Representation for Reinforcement Learning
2022/12/17 by Tongzheng Ren, Ren, Tongzheng, Chenjun Xiao +13 · 1 citation
Computer Science · #Reinforcement Learning in Robotics
- Kimi K3: Open Frontier Intelligence
2026/07/27 by Kimi Team, Tongtong Bai, Yifan Bai +398 · 1 voice
#cs.CL #cs.LG