Renyuan Xu
- DeepSeekMoE: Towards Ultimate Expert Specialization in Mixture-of-Experts Language Models
2024/01/11 by Damai Dai, Dai, Damai, Chengqi Deng +31 · 174 citations
Computer Science · #Computation and Language (cs.CL) #Expert finding and Q&A systems #FOS: Computer and information sciences #Multimodal Machine Learning Applications #Topic Modeling
- DeepSeek LLM: Scaling Open-Source Language Models with Longtermism
2024/01/05 by DeepSeek-AI, Xiao Guo Bi, : +170 · 110 citations
Computer Science · #Natural Language Processing Techniques #Topic Modeling #Text Readability and Simplification
- A General Framework for Learning Mean-Field Games
2020/03/13 by Xin Guo, Anran Hu, Guo, Xin +5 · 5 citations
Decision Sciences · Economics, Econometrics and Finance · Social Sciences · #Decision-Making and Behavioral Economics #Experimental Behavioral Economics Studies #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Control (math.OC) #Sports Analytics and Performance
- A General Framework for Learning Mean-Field Games
2022/06/21 by Xin Guo, Anran Hu, Renyuan Xu +1 · 5 citations
Computer Science · Decision Sciences · Social Sciences · #Auction Theory and Applications #Experimental Behavioral Economics Studies #Reinforcement Learning in Robotics
- Mean-Field Controls with Q-learning for Cooperative MARL: Convergence and Complexity Analysis
2020/02/10 by Haotian Gu, Xin Guo, Gu, Haotian +5 · 3 citations
Engineering · #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Control (math.OC) #Traffic control and management
- Dynamic Programming Principles for Mean-Field Controls with Learning
2019/11/17 by Haotian Gu, Xin Guo, Gu, Haotian +5 · 5 citations
Computer Science · Decision Sciences · Engineering · #49N80 #60J20 #68T05 #Advanced Bandit Algorithms Research #Advanced Control Systems Optimization #FOS: Mathematics #Optimization and Control (math.OC) #Reinforcement Learning in Robotics
- Neural Network-Based Score Estimation in Diffusion Models: Optimization and Generalization
2024/01/28 by Yinbin Han, Han, Yinbin, Meisam Razaviyayn +3 · 4 citations
Physics and Astronomy · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Model Reduction and Neural Networks
- Fast Policy Learning for Linear Quadratic Control with Entropy Regularization
2023/11/23 by Xin Guo, Guo, Xin, Xinyu Li +3 · 4 citations
Computer Science · Engineering · #Adaptive Dynamic Programming Control #Advanced Control Systems Optimization #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Optimization and Control (math.OC) #Reinforcement Learning in Robotics
- Exploratory Optimal Stopping: A Singular Control Formulation
2024/08/18 by Jodi Dianetti, Giorgio Ferrari, Dianetti, Jodi +3 · 5 citations
Computer Science · Engineering · #35F21 #49-XX #68T05 #93E35 #Advanced Control Systems Optimization #FOS: Computer and information sciences #FOS: Economics and business #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Mathematical Finance (q-fin.MF) #Optimization and Control (math.OC) #Optimization and Search Problems
- Mean-Field Multi-Agent Reinforcement Learning: A Decentralized Network Approach
2021/08/05 by Haotian Gu, Gu, Haotian, Xin Guo +5 · 1 citation
Computer Science · #49N80 #68T05 #68T07 #90C40 #Adaptive Dynamic Programming Control #Distributed Control Multi-Agent Systems #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Optimization and Control (math.OC) #Reinforcement Learning in Robotics
- Diffusion Factor Models: Generating High-Dimensional Returns with Factor Structure
2025/04/09 by Minshuo Chen, Chen, Minshuo, Renyuan Xu +5 · 4 citations
Economics, Econometrics and Finance · Mathematics · Computer Science · #Stochastic processes and financial applications #Tensor decomposition and applications #Stochastic Gradient Optimization Techniques
- Periodic Trading Activities in Financial Markets: Mean-field Liquidation Game with Major-Minor Players
2024/08/18 by Yufan Chen, Lan Wu, Chen, Yufan +5 · 2 citations
Economics, Econometrics and Finance · #Complex Systems and Time Series Analysis #Economic theories and models #Stochastic processes and financial applications
- SCALAR: Scale-wise Controllable Visual Autoregressive Learning
2025/07/26 by Renyuan Xu, Dongyang Jin, Xu, Ryan +11 · 9 citations
Computer Science · #Generative Adversarial Networks and Image Synthesis #Multimodal Machine Learning Applications #Domain Adaptation and Few-Shot Learning
- Online Optimization of Difference-of-Convex Compositions with Smooth Mappings
2026/07/21 by Jingwei Ji, Jong-Shi Pang, Renyuan Xu
#math.OC #cs.LG
- Weak-to-Strong Learning in Decision Making
2026/07/20 by Jingwei Ji, Renyuan Xu
#cs.LG