Wang, Sid
- LlamaRL: A Distributed Asynchronous Reinforcement Learning Framework for Efficient Large-scale LLM Training
2025/05/29 by Wu, Bo, Wang, Sid, Tang, Yunhao +11 · 15 citations
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG)
- Beyond Verifiable Rewards: Scaling Reinforcement Learning for Language Models to Unverifiable Data
2025/03/25 by Yunhao Tang, S Wang, Tang, Yunhao +5 · 8 citations
Computer Science · #Topic Modeling #Natural Language Processing Techniques #Speech and dialogue systems
- READ: Recurrent Adaptation of Large Transformers
2023/05/24 by John Nguyen, Sid Wang, Nguyen, John +5 · 1 voice · 1 citation
#cs.LG #cs.AI
- Prompt Curriculum Learning for Efficient LLM Post-Training
2025/10/01 by Zhaolin Gao, Gao, Zhaolin, Joongwon Kim +11 · 6 citations
Social Sciences · #Computation and Language (cs.CL) #FOS: Computer and information sciences #Higher Education Learning Practices #Machine Learning (cs.LG)
- SPG: Sandwiched Policy Gradient for Masked Diffusion Language Models
2025/10/10 by Chenyu Wang, Paria Rashidinejad, Wang, Chenyu +20 · 4 citations
Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Machine Learning in Healthcare #Multimodal Machine Learning Applications #Topic Modeling