Niu, Yazhe
- AMEX: Android Multi-annotation Expo Dataset for Mobile GUI Agents
2024/07/03 by Yuxiang Chai, Siyuan Huang, Chai, Yuxiang +13 · 38 citations
Computer Science · #Artificial Intelligence (cs.AI) #Context-Aware Activity Recognition Systems #FOS: Computer and information sciences #Human-Computer Interaction (cs.HC) #Mobile Agent-Based Network Management #Multimedia (cs.MM) #Web Data Mining and Analysis
- Kimina-Prover Preview: Towards Large Formal Reasoning Models with Reinforcement Learning
2025/04/15 by Wang, Haiming, Unsal, Mert, Lin, Xiaohan +37 · 69 citations
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences
- ACE: Cooperative Multi-agent Q-learning with Bidirectional Action-Dependency
2022/11/29 by Chuming Li, Li, Chuming, Jie Liu +13 · 4 citations
Computer Science · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics
- UniZero: Generalized and Efficient Planning with Scalable Latent World Models
2024/06/15 by Yuan Pu, Pu, Yuan, Yazhe Niu +9 · 5 citations
Computer Science · #AI-based Problem Solving and Planning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and Algorithms #Robotic Path Planning Algorithms
- AIM 2019 Challenge on Constrained Super-Resolution: Methods and Results
2019/11/04 by Kai Zhang, Shuhang Gu, Zhang, Kai +54 · 2 citations
Computer Science · Engineering · #Advanced Image Processing Techniques #Advanced Vision and Imaging #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #FOS: Electrical engineering #Image Processing Techniques and Applications #Image and Video Processing (eess.IV) #electronic engineering #information engineering
- LightZero: A Unified Benchmark for Monte Carlo Tree Search in General Sequential Decision Scenarios
2023/10/12 by Yazhe Niu, Yuan Pu, Niu, Yazhe +15 · 3 citations
Computer Science · #Artificial Intelligence in Games #Reinforcement Learning in Robotics #Data Management and Algorithms
- A Perspective of Q-value Estimation on Offline-to-Online Reinforcement Learning
2023/12/12 by Yinmin Zhang, Zhang, Yinmin, Jie Liu +11 · 3 citations
Computer Science · #Reinforcement Learning in Robotics
- Let Androids Dream of Electric Sheep: A Human-Inspired Image Implication Understanding and Reasoning Framework
2025/05/22 by Zhang, Chenhao, Niu, Yazhe · 2 citations
#Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #Computers and Society (cs.CY) #FOS: Computer and information sciences
- ReZero: Boosting MCTS-based Algorithms by Backward-view and Entire-buffer Reanalyze
2024/04/25 by Chunyu Xuan, Xuan, Chunyu, Yazhe Niu +7 · 1 citation
Computer Science · #Algorithms and Data Compression #Neural Networks and Applications
- Revisiting Generative Policies: A Simpler Reinforcement Learning Algorithmic Perspective
2024/12/02 by J. Q. Zhang, Zhang, Jinouwen, Rongkun Xue +11 · 1 citation
Decision Sciences · #Auction Theory and Applications
- Hierarchical Balance Packing: Towards Efficient Supervised Fine-tuning for Long-Context LLM
2025/03/10 by Yongqiang Yao, Yao, Yongqiang, Jingru Tan +16 · 1 citation
Computer Science · Engineering · #Digital Rights Management and Security #Natural Language Processing Techniques #Vehicle License Plate Recognition