Jiazheng Zhang
- AgentGym-RL: Training LLM Agents for Long-Horizon Decision Making through Multi-Turn Reinforcement Learning
2025/09/10 by Zhiheng Xi, Xi, Zhiheng, Jinyan Huang +46 · 2 voices · 16 citations
Computer Science · #cs.LG #cs.AI #cs.CL
- Better Process Supervision with Bi-directional Rewarding Signals
2025/03/06 by Wenxiang Chen, Chen, Wenxiang, Wei He +19 · 7 citations
Business, Management and Accounting · Computer Science · #Business Process Modeling and Analysis #Topic Modeling #Explainable Artificial Intelligence (XAI)
- Can RL Improve Generalization of LLM Agents? An Empirical Study
2026/03/12 by Zhiheng Xi, Xin Guo, Jiaqi Liu +11 · 1 voice
Computer Science · #cs.AI
- Multi-Programming Language Sandbox for LLMs
2024/10/30 by Shihan Dou, Jiazheng Zhang, Dou, Shihan +52 · 4 citations
Computer Science · #Digital Rights Management and Security
- Two Minds Better Than One: Collaborative Reward Modeling for LLM Alignment
2025/05/15 by Jiazheng Zhang, Zhang, Jiazheng, Zizhuo Zhang +20 · 4 citations
Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #Explainable Artificial Intelligence (XAI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Recommender Systems and Techniques #Topic Modeling
- IACM-RL: Intent-Aware Context Management and Reinforcement Learning for Complex Tool Invocation under Dynamic Intent Fluctuations
2026/08/03 by Dingwei Zhu, Jiahan Li, Chengjun Pan +22
Computer Science · #cs.CL #cs.AI