vix.ing · top · new · best · stats · spec

Xiao, Chenjun

  1. Kimi k1.5: Scaling Reinforcement Learning with LLMs
    2025/01/22 by Angang Du, Kimi Team, Bofei Gao +173 · 5 voices · 256 citations
    Engineering · Computer Science · #Robot Manipulation and Learning #Machine Learning and Data Classification #Machine Learning and Algorithms
  2. Kimi K2: Open Agentic Intelligence
    2025/07/28 by Kimi Team, Yifan Bai, Bai, Yifan +363 · 6 voices · 85 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Machine Learning (cs.LG) #cs.AI #cs.CL #cs.LG
  3. On the Global Convergence Rates of Softmax Policy Gradient Methods
    2020/05/13 by Jincheng Mei, Chenjun Xiao, Mei, Jincheng +5 · 20 citations
    Computer Science · Decision Sciences · #Stochastic Gradient Optimization Techniques #Reinforcement Learning in Robotics #Advanced Bandit Algorithms Research
  4. Kimina-Prover Preview: Towards Large Formal Reasoning Models with Reinforcement Learning
    2025/04/15 by Wang, Haiming, Unsal, Mert, Lin, Xiaohan +37 · 48 citations
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences
  5. Learning to Combat Compounding-Error in Model-Based Reinforcement Learning
    2019/12/24 by Xiao, Chenjun, Wu, Yifan, Ma, Chen +2 · 4 citations
    #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
  6. On the Optimality of Batch Policy Optimization Algorithms
    2021/04/06 by Chenjun Xiao, Xiao, Chenjun, Yifan Wu +13 · 2 citations
    Computer Science · Engineering · #Advanced Manufacturing and Logistics Optimization #FOS: Computer and information sciences #Machine Learning (cs.LG) #Optimization and Search Problems #Scheduling and Optimization Algorithms
  7. HarmonyDream: Task Harmonization Inside World Models
    2023/09/30 by Ma, Haoyu, Wu, Jialong, Feng, Ningya +5 · 3 citations
    #FOS: Computer and information sciences #Machine Learning (cs.LG)
  8. Rethinking Decision Transformer via Hierarchical Reinforcement Learning
    2023/11/01 by Ma, Yi, Xiao, Chenjun, Liang, Hebin +1 · 3 citations
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG)
  9. Diffusion Spectral Representation for Reinforcement Learning
    2024/06/23 by Dmitry Shribak, Chen-Xiao Gao, Shribak, Dmitry +7 · 2 citations
    Computer Science · #Reinforcement Learning in Robotics
  10. The In-Sample Softmax for Offline Reinforcement Learning
    2023/02/28 by Chenjun Xiao, Han Wang, Xiao, Chenjun +7 · 1 citation
    Computer Science · #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #Data Stream Mining Techniques #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
  11. Conditionally Optimistic Exploration for Cooperative Deep Multi-Agent Reinforcement Learning
    2023/03/16 by Xutong Zhao, Zhao, Xutong, Yangchen Pan +7 · 1 citation
    Computer Science · #Adversarial Robustness in Machine Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics
  12. Iteratively Refined Behavior Regularization for Offline Reinforcement Learning
    2023/06/09 by Xiaohan Hu, Hu, Xiaohan, Yi Ma +6 · 1 citation
    Computer Science · #Artificial Intelligence (cs.AI) #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and Data Classification #Reinforcement Learning in Robotics
  13. Behavior-Regularized Diffusion Policy Optimization for Offline Reinforcement Learning
    2025/02/07 by Chen-Xiao Gao, Chenyang Wu, Gao, Chen-Xiao +9 · 2 citations
    Computer Science · Engineering · #Artificial Intelligence (cs.AI) #Elevator Systems and Control #FOS: Computer and information sciences #Machine Learning (cs.LG) #Reinforcement Learning in Robotics #Traffic control and management
  14. Hindsight Preference Learning for Offline Preference-based Reinforcement Learning
    2024/07/05 by Chen-Xiao Gao, Shengjun Fang, Gao, Chen-Xiao +7 · 1 citation
    Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Fuzzy Logic and Control Systems #Machine Learning (cs.LG) #Reinforcement Learning in Robotics
  15. Provable Representation with Efficient Planning for Partial Observable Reinforcement Learning
    2023/11/20 by Zhang, Hongming, Ren, Tongzheng, Xiao, Chenjun +2 · 1 citation
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
  16. An MRP Formulation for Supervised Learning: Generalized Temporal Difference Learning Models
    2024/04/23 by Yangchen Pan, Pan, Yangchen, Junfeng Wen +5 · 1 citation
    Computer Science · #Speech Recognition and Synthesis
  17. Latent Variable Representation for Reinforcement Learning
    2022/12/17 by Tongzheng Ren, Ren, Tongzheng, Chenjun Xiao +13 · 1 citation
    Computer Science · #Reinforcement Learning in Robotics
  18. Large Language Model-Enhanced Multi-Armed Bandits
    2025/02/03 by Sun, Jiahang, Wang, Zhiyong, Yang, Runhan +3 · 1 citation
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG)