vix.ing · top · new · best · stats · spec

Chenjun Xiao

  1. Kimi k1.5: Scaling Reinforcement Learning with LLMs
    2025/01/22 by Kimi Team, Angang Du, Du, Angang +173 · 5 voices · 299 citations
    Engineering · Computer Science · #Robot Manipulation and Learning #Machine Learning and Data Classification #Machine Learning and Algorithms
  2. Kimi K2: Open Agentic Intelligence
    2025/07/28 by Yifan Bai, Kimi Team, Bai, Yifan +363 · 6 voices · 85 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Machine Learning (cs.LG) #cs.AI #cs.CL #cs.LG
  3. On the Global Convergence Rates of Softmax Policy Gradient Methods
    2020/05/13 by Jincheng Mei, Chenjun Xiao, Mei, Jincheng +5 · 25 citations
    Computer Science · Decision Sciences · #Stochastic Gradient Optimization Techniques #Reinforcement Learning in Robotics #Advanced Bandit Algorithms Research
  4. On the Optimality of Batch Policy Optimization Algorithms
    2021/04/06 by Chenjun Xiao, Xiao, Chenjun, Yifan Wu +13 · 2 citations
    Computer Science · Engineering · #Advanced Manufacturing and Logistics Optimization #FOS: Computer and information sciences #Machine Learning (cs.LG) #Optimization and Search Problems #Scheduling and Optimization Algorithms
  5. Diffusion Spectral Representation for Reinforcement Learning
    2024/06/23 by Dmitry Shribak, Chen-Xiao Gao, Shribak, Dmitry +7 · 3 citations
    Computer Science · #Reinforcement Learning in Robotics
  6. Iteratively Refined Behavior Regularization for Offline Reinforcement Learning
    2023/06/09 by Xiaohan Hu, Hu, Xiaohan, Yi Ma +6 · 2 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and Data Classification #Reinforcement Learning in Robotics
  7. Conditionally Optimistic Exploration for Cooperative Deep Multi-Agent Reinforcement Learning
    2023/03/16 by Xutong Zhao, Yangchen Pan, Zhao, Xutong +7 · 1 citation
    Computer Science · #Adversarial Robustness in Machine Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics
  8. Behavior-Regularized Diffusion Policy Optimization for Offline Reinforcement Learning
    2025/02/07 by Chen-Xiao Gao, Chenyang Wu, Gao, Chen-Xiao +9 · 2 citations
    Computer Science · Engineering · #Artificial Intelligence (cs.AI) #Elevator Systems and Control #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics #Traffic control and management
  9. The In-Sample Softmax for Offline Reinforcement Learning
    2023/02/28 by Chenjun Xiao, Xiao, Chenjun, Han Wang +7 · 1 citation
    Computer Science · #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #Data Stream Mining Techniques #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
  10. Hindsight Preference Learning for Offline Preference-based Reinforcement Learning
    2024/07/05 by Chen-Xiao Gao, Gao, Chen-Xiao, Shengjun Fang +7 · 1 citation
    Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Fuzzy Logic and Control Systems #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
  11. An MRP Formulation for Supervised Learning: Generalized Temporal Difference Learning Models
    2024/04/23 by Yangchen Pan, Junfeng Wen, Pan, Yangchen +5 · 1 citation
    Computer Science · #Speech Recognition and Synthesis
  12. Latent Variable Representation for Reinforcement Learning
    2022/12/17 by Tongzheng Ren, Ren, Tongzheng, Chenjun Xiao +13 · 1 citation
    Computer Science · #Reinforcement Learning in Robotics
  13. Kimi K3: Open Frontier Intelligence
    2026/07/27 by Kimi Team, Tongtong Bai, Yifan Bai +398 · 1 voice
    #cs.CL #cs.LG