Zhou, Haotian
- Let's reward step by step: Step-Level reward model as the Navigators for Reasoning
2023/10/16 by Qianli Ma, Haotian Zhou, Ma, Qianli +11 · 13 citations
Computer Science · #Topic Modeling #Natural Language Processing Techniques #Software Engineering Research
- UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning
2025/09/02 by Haoming Wang, Wang, Haoming, Haoyang Zou +201 · 50 citations
Computer Science · Psychology · Engineering · #Context-Aware Activity Recognition Systems #Social Robot Interaction and HRI #Robotics and Automated Systems
- DavIR: Data Selection via Implicit Reward for Large Language Models
2023/10/16 by Zhou, Haotian, Liu, Tingkai, Ma, Qianli +5 · 1 citation
#Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Machine Learning (cs.LG)
- HeteGen: Heterogeneous Parallel Inference for Large Language Models on Resource-Constrained Devices
2024/03/02 by Xuanlei Zhao, Zhao, Xuanlei, Bin Jia +9 · 1 citation
Computer Science · #Topic Modeling