Yuan, Jiarui
- Process Reinforcement through Implicit Rewards
2025/02/03 by Ganqu Cui, Lifan Yuan, Cui, Ganqu +45 · 101 citations
Computer Science · #Reinforcement Learning in Robotics
- Optima: Optimizing Effectiveness and Efficiency for LLM-Based Multi-Agent System
2024/10/10 by Chen, Weize, Yuan, Jiarui, Qian, Chen +3 · 10 citations
#Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences
- MiniCPM4: Ultra-Efficient LLMs on End Devices
2025/06/09 by Chaojun Xiao, MiniCPM Team, Yuxuan Li +148 · 22 citations
Computer Science · #Topic Modeling #Natural Language Processing Techniques #Multimodal Machine Learning Applications
- The Overthinker's DIET: Cutting Token Calories with DIfficulty-AwarE Training
2025/05/25 by Chen, Weize, Yuan, Jiarui, Jin, Tailin +4 · 4 citations
#Computation and Language (cs.CL) #FOS: Computer and information sciences
- Beyond Natural Language: LLMs Leveraging Alternative Formats for Enhanced Reasoning and Communication
2024/02/28 by Weize Chen, Chenfei Yuan, Chen, Weize +15 · 1 citation
Computer Science · Social Sciences · #Artificial Intelligence (cs.AI) #Artificial Intelligence in Law #Computation and Language (cs.CL) #FOS: Computer and information sciences #Law, AI, and Intellectual Property