Liu, Weilin
- On Designing Effective RL Reward at Training Time for LLM Reasoning
2024/10/19 by Jiaxuan Gao, Gao, Jiaxuan, Shusheng Xu +15 · 29 citations
Computer Science · #Software Engineering Research
- Learning Zero-Shot Cooperation with Humans, Assuming Humans Are Biased
2023/02/03 by Yu, Chao, Gao, Jiaxuan, Liu, Weilin +5 · 5 citations
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences
- RLinf: Flexible and Efficient Large-scale Reinforcement Learning via Macro-to-Micro Flow Transformation
2025/09/19 by Chao Yu, Yu, Chao, Yuanqing Wang +52 · 8 citations
Computer Science · #Artificial Intelligence (cs.AI) #Distributed #FOS: Computer and information sciences #Machine Learning (cs.LG) #Parallel #Reinforcement Learning in Robotics #and Cluster Computing (cs.DC)
- Megrez-Omni Technical Report
2025/02/19 by Boxun Li, Li, Boxun, Yadong Li +26 · 2 citations
Computer Science · #Computation and Language (cs.CL) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multimodal Machine Learning Applications #Natural Language Processing Techniques #Speech Recognition and Synthesis