vix.ing · top · new · best · stats · spec

Shusheng Xu

  1. AReaL: A Large-Scale Asynchronous Reinforcement Learning System for Language Reasoning
    2025/05/30 by Fu Wei, Jiaxuan Gao, Fu, Wei +21 · 68 citations
    Computer Science · #Natural Language Processing Techniques #Fuzzy Logic and Control Systems #Speech and dialogue systems
  2. On Designing Effective RL Reward at Training Time for LLM Reasoning
    2024/10/19 by Jiaxuan Gao, Shusheng Xu, Gao, Jiaxuan +15 · 24 citations
    Computer Science · #Software Engineering Research
  3. Beyond Ten Turns: Unlocking Long-Horizon Agentic Search with Large-Scale Asynchronous RL
    2025/08/11 by Jiaxuan Gao, Gao, Jiaxuan, Wei Fu +13 · 52 citations
    Computer Science · #Robotic Path Planning Algorithms #Optimization and Search Problems #Reinforcement Learning in Robotics