Tianyuan Wu
- Reinforcement Learning Optimization for Large-Scale Learning: An Efficient and User-Friendly Scaling Library
2025/06/06 by Weixun Wang, Wang, Weixun, Xiong, Shaopan +73 · 38 citations
Computer Science · #Reinforcement Learning in Robotics #Machine Learning and Data Classification #Stochastic Gradient Optimization Techniques
- CaraServe: CPU-Assisted and Rank-Aware LoRA Serving for Generative LLM Inference
2024/01/20 by Suyi Li, Hanfeng Lu, Li, Suyi +15 · 4 citations
Computer Science · #Distributed #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Natural Language Processing Techniques #Parallel #Topic Modeling #and Cluster Computing (cs.DC)
- ActPlane: Programmable OS-Level Policy Enforcement for Agent Harnesses
2026/06/23 by Yusheng Zheng, Tianyuan Wu, Quanzhi Fu +6 · 2 voices
#cs.OS
- RollPacker: Mitigating Long-Tail Rollouts for Fast, Synchronous RL Post-Training
2025/09/25 by Wei Gao, Yuheng Zhao, Gao, Wei +24 · 7 citations
Computer Science · Engineering · #Distributed #FOS: Computer and information sciences #Machine Learning (cs.LG) #Parallel #Real-Time Systems Scheduling #Real-time simulation and control systems #Software Reliability and Analysis Research #and Cluster Computing (cs.DC)
- Echo: Simulating Distributed Training At Scale
2024/12/17 by Y. Feng, Feng, Yicheng, Y. Chen +17 · 1 citation
Decision Sciences · Computer Science · #Simulation Techniques and Applications #Intelligent Tutoring Systems and Adaptive Learning