Yanxiao Zhao
- GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents
2026/04/29 by GLM-V Team, :, Wenyi Hong +95 · 10 voices · 1 citation
#cs.CV
- ComputerRL: Scaling End-to-End Online Reinforcement Learning for Computer Use Agents
2025/08/19 by Hanyu Lai, Xiao Liu, Lai, Hanyu +16 · 16 citations
Computer Science · #Reinforcement Learning in Robotics
- SATQuest: A Verifier for Logical Reasoning Evaluation and Reinforcement Fine-Tuning of LLMs
2025/08/31 by Yanxiao Zhao, Yaqian Li, Zhao, Yanxiao +15 · 1 citation
#cs.AI #cs.LG #cs.LO