Frunza, Oana
- Reinforcing Multi-Turn Reasoning in LLM Agents via Turn-Level Reward Design
2025/05/17 by Wei, Quan, Siliang Zeng, Chenliang Li +17 · 33 citations
Computer Science · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Natural Language Processing Techniques #Speech and dialogue systems #Topic Modeling