vix.ing · top · new · best · stats · spec

Jiazheng Zhang

  1. AgentGym-RL: Training LLM Agents for Long-Horizon Decision Making through Multi-Turn Reinforcement Learning
    2025/09/10 by Zhiheng Xi, Xi, Zhiheng, Jinyan Huang +46 · 2 voices · 16 citations
    Computer Science · #cs.LG #cs.AI #cs.CL
  2. Better Process Supervision with Bi-directional Rewarding Signals
    2025/03/06 by Wenxiang Chen, Chen, Wenxiang, Wei He +19 · 7 citations
    Business, Management and Accounting · Computer Science · #Business Process Modeling and Analysis #Topic Modeling #Explainable Artificial Intelligence (XAI)
  3. Can RL Improve Generalization of LLM Agents? An Empirical Study
    2026/03/12 by Zhiheng Xi, Xin Guo, Jiaqi Liu +11 · 1 voice
    Computer Science · #cs.AI
  4. Multi-Programming Language Sandbox for LLMs
    2024/10/30 by Shihan Dou, Jiazheng Zhang, Dou, Shihan +52 · 4 citations
    Computer Science · #Digital Rights Management and Security
  5. Two Minds Better Than One: Collaborative Reward Modeling for LLM Alignment
    2025/05/15 by Jiazheng Zhang, Zhang, Jiazheng, Zizhuo Zhang +20 · 4 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #Explainable Artificial Intelligence (XAI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Recommender Systems and Techniques #Topic Modeling
  6. IACM-RL: Intent-Aware Context Management and Reinforcement Learning for Complex Tool Invocation under Dynamic Intent Fluctuations
    2026/08/03 by Dingwei Zhu, Jiahan Li, Chengjun Pan +22
    Computer Science · #cs.CL #cs.AI