Xiao, Chenjun
- Kimi k1.5: Scaling Reinforcement Learning with LLMs
2025/01/22 by Angang Du, Kimi Team, Bofei Gao +173 · 5 voices · 256 citations
Engineering · Computer Science · #Robot Manipulation and Learning #Machine Learning and Data Classification #Machine Learning and Algorithms
- Kimi K2: Open Agentic Intelligence
2025/07/28 by Kimi Team, Yifan Bai, Bai, Yifan +363 · 6 voices · 85 citations
Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Machine Learning (cs.LG) #cs.AI #cs.CL #cs.LG
- On the Global Convergence Rates of Softmax Policy Gradient Methods
2020/05/13 by Jincheng Mei, Chenjun Xiao, Mei, Jincheng +5 · 20 citations
Computer Science · Decision Sciences · #Stochastic Gradient Optimization Techniques #Reinforcement Learning in Robotics #Advanced Bandit Algorithms Research
- Kimina-Prover Preview: Towards Large Formal Reasoning Models with Reinforcement Learning
2025/04/15 by Wang, Haiming, Unsal, Mert, Lin, Xiaohan +37 · 48 citations
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences
- Learning to Combat Compounding-Error in Model-Based Reinforcement Learning
2019/12/24 by Xiao, Chenjun, Wu, Yifan, Ma, Chen +2 · 4 citations
#FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
- On the Optimality of Batch Policy Optimization Algorithms
2021/04/06 by Chenjun Xiao, Xiao, Chenjun, Yifan Wu +13 · 2 citations
Computer Science · Engineering · #Advanced Manufacturing and Logistics Optimization #FOS: Computer and information sciences #Machine Learning (cs.LG) #Optimization and Search Problems #Scheduling and Optimization Algorithms
- HarmonyDream: Task Harmonization Inside World Models
2023/09/30 by Ma, Haoyu, Wu, Jialong, Feng, Ningya +5 · 3 citations
#FOS: Computer and information sciences #Machine Learning (cs.LG)
- Rethinking Decision Transformer via Hierarchical Reinforcement Learning
2023/11/01 by Ma, Yi, Xiao, Chenjun, Liang, Hebin +1 · 3 citations
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG)
- Diffusion Spectral Representation for Reinforcement Learning
2024/06/23 by Dmitry Shribak, Chen-Xiao Gao, Shribak, Dmitry +7 · 2 citations
Computer Science · #Reinforcement Learning in Robotics
- The In-Sample Softmax for Offline Reinforcement Learning
2023/02/28 by Chenjun Xiao, Han Wang, Xiao, Chenjun +7 · 1 citation
Computer Science · #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #Data Stream Mining Techniques #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
- Conditionally Optimistic Exploration for Cooperative Deep Multi-Agent Reinforcement Learning
2023/03/16 by Xutong Zhao, Zhao, Xutong, Yangchen Pan +7 · 1 citation
Computer Science · #Adversarial Robustness in Machine Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics
- Iteratively Refined Behavior Regularization for Offline Reinforcement Learning
2023/06/09 by Xiaohan Hu, Hu, Xiaohan, Yi Ma +6 · 1 citation
Computer Science · #Artificial Intelligence (cs.AI) #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and Data Classification #Reinforcement Learning in Robotics
- Behavior-Regularized Diffusion Policy Optimization for Offline Reinforcement Learning
2025/02/07 by Chen-Xiao Gao, Chenyang Wu, Gao, Chen-Xiao +9 · 2 citations
Computer Science · Engineering · #Artificial Intelligence (cs.AI) #Elevator Systems and Control #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics #Traffic control and management
- Hindsight Preference Learning for Offline Preference-based Reinforcement Learning
2024/07/05 by Chen-Xiao Gao, Shengjun Fang, Gao, Chen-Xiao +7 · 1 citation
Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Fuzzy Logic and Control Systems #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
- Provable Representation with Efficient Planning for Partial Observable Reinforcement Learning
2023/11/20 by Zhang, Hongming, Ren, Tongzheng, Xiao, Chenjun +2 · 1 citation
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
- An MRP Formulation for Supervised Learning: Generalized Temporal Difference Learning Models
2024/04/23 by Yangchen Pan, Pan, Yangchen, Junfeng Wen +5 · 1 citation
Computer Science · #Speech Recognition and Synthesis
- Latent Variable Representation for Reinforcement Learning
2022/12/17 by Tongzheng Ren, Ren, Tongzheng, Chenjun Xiao +13 · 1 citation
Computer Science · #Reinforcement Learning in Robotics
- Large Language Model-Enhanced Multi-Armed Bandits
2025/02/03 by Sun, Jiahang, Wang, Zhiyong, Yang, Runhan +3 · 1 citation
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG)