Mao, Yixiu
- Model Predictive Task Sampling for Efficient and Robust Adaptation
2025/01/19 by Wang, Qi, Xiao, Zehao, Mao, Yixiu +4 · 11 citations
#FOS: Computer and information sciences #Machine Learning (cs.LG)
- Can Prompt Difficulty be Online Predicted for Accelerating RL Finetuning of Reasoning Models?
2025/07/07 by Yun Qu, Qu, Yun, Qi Wang +9 · 19 citations
Computer Science · #Artificial Intelligence (cs.AI) #Bayesian Modeling and Causal Inference #FOS: Computer and information sciences #Intelligent Tutoring Systems and Adaptive Learning #Machine Learning (cs.LG) #Semantic Web and Ontologies
- Doubly Mild Generalization for Offline Reinforcement Learning
2024/11/12 by Mao, Yixiu, Wang, Qi, Qu, Yun +2 · 9 citations
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG)
- Latent Reward: LLM-Empowered Credit Assignment in Episodic Reinforcement Learning
2024/12/15 by Yun Qu, Qu, Yun, Yuhang Jiang +11 · 8 citations
Computer Science · Business, Management and Accounting · #Evolutionary Algorithms and Applications #Digital Platforms and Economics #Reinforcement Learning in Robotics
- Supported Trust Region Optimization for Offline Reinforcement Learning
2023/11/15 by Yixiu Mao, Hongchang Zhang, Mao, Yixiu +7 · 4 citations
Computer Science · Engineering · #Reinforcement Learning in Robotics #Robotic Locomotion and Control
- Robust Fast Adaptation from Adversarially Explicit Task Distribution Generation
2024/07/28 by Cheems Wang, Yiqin Lv, Wang, Cheems +9 · 3 citations
Computer Science · #Adversarial Robustness in Machine Learning #Anomaly Detection Techniques and Applications #FOS: Computer and information sciences #Machine Learning (cs.LG)
- Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments
2025/04/27 by Yun Qu, Qi Wang, Qu, Yun +7 · 6 citations
Computer Science · #Mobile Crowdsensing and Crowdsourcing #Data Stream Mining Techniques #Machine Learning and Data Classification
- Offline Reinforcement Learning with OOD State Correction and OOD Action Suppression
2024/10/25 by Yixiu Mao, Mao, Yixiu, Qi Wang +7 · 5 citations
Engineering · Neuroscience · #Artificial Intelligence (cs.AI) #EEG and Brain-Computer Interfaces #Elevator Systems and Control #FOS: Computer and information sciences #Machine Learning (cs.LG) #Traffic control and management
- Stop Wandering, Find the Keys: LLMs Discriminate Key States for Efficient Multi-Agent Exploration
2024/10/03 by Qu Yun, Qu, Yun, Boyuan Wang +15 · 2 citations
Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Multiagent Systems (cs.MA) #Semantic Web and Ontologies