vix.ing · top · new · best · stats · spec

Frunza, Oana

  1. Reinforcing Multi-Turn Reasoning in LLM Agents via Turn-Level Reward Design
    2025/05/17 by Wei, Quan, Siliang Zeng, Chenliang Li +17 · 33 citations
    Computer Science · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Natural Language Processing Techniques #Speech and dialogue systems #Topic Modeling