Zheng, Qinqing
- Beyond A*: Better Planning with Transformers via Search Dynamics Bootstrapping
2024/02/21 by Lucas Lehnert, Sainbayar Sukhbaatar, Lehnert, Lucas +11 · 5 voices · 12 citations
Computer Science · #AI-based Problem Solving and Planning #Advanced Database Systems and Queries #Artificial Intelligence in Games #cs.AI
- Dualformer: Controllable Fast and Slow Thinking by Learning with Randomized Reasoning Traces
2024/10/13 by D. Su, DiJia Su, Sainbayar Sukhbaatar +8 · 3 voices · 13 citations
Computer Science · #Neural Networks and Applications #cs.AI #cs.LG #cs.LO
- Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning
2025/02/05 by DiJia Su, Hanlin Zhu, Su, DiJia +9 · 2 voices · 23 citations
Computer Science · #Natural Language Processing Techniques #Semantic Web and Ontologies #Topic Modeling #cs.AI #cs.CL #cs.LG #cs.LO
- Guided Flows for Generative Modeling and Decision Making
2023/11/22 by Qinqing Zheng, Zheng, Qinqing, Matt Le +9 · 22 citations
Computer Science · #Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Music and Audio Processing #Reinforcement Learning in Robotics #Robotics (cs.RO) #Topic Modeling
- d1: Scaling Reasoning in Diffusion Large Language Models via Reinforcement Learning
2025/04/16 by Siyan Zhao, Zhao, Siyan, Devaansh Gupta +5 · 50 citations
Computer Science · #Topic Modeling #Reinforcement Learning in Robotics #Multimodal Machine Learning Applications
- Online Decision Transformer
2022/02/11 by Qinqing Zheng, Amy Zhang, Zheng, Qinqing +3 · 10 citations
Computer Science · #Reinforcement Learning in Robotics #Software Engineering Research
- Convergence Analysis for Rectangular Matrix Completion Using Burer-Monteiro Factorization and Gradient Descent
2016/05/23 by Qinqing Zheng, Zheng, Qinqing, John Lafferty +1 · 9 citations
Computer Science · Engineering · Mathematics · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Matrix Theory and Algorithms #Numerical methods in inverse problems #Sparse and Compressive Sensing Techniques
- Dual RL: Unification and New Methods for Reinforcement and Imitation Learning
2023/02/16 by Harshit Sikchi, Sikchi, Harshit, Zheng, Qinqing +4 · 6 citations
Computer Science · Engineering · #Reinforcement Learning in Robotics #Modular Robots and Swarm Intelligence #Evolutionary Algorithms and Applications
- Diffusion World Model: Future Modeling Beyond Step-by-Step Rollout for Offline Reinforcement Learning
2024/02/05 by Zihan Ding, Amy Zhang, Ding, Zihan +5 · 2 voices · 1 citation
Computer Science · Economics, Econometrics and Finance · Physics and Astronomy · #Artificial Intelligence (cs.AI) #Complex Systems and Time Series Analysis #FOS: Computer and information sciences #Machine Learning (cs.LG) #Opinion Dynamics and Social Influence #cs.AI #cs.LG
- Online Intrinsic Rewards for Decision Making Agents from Large Language Model Feedback
2024/10/30 by Zheng, Qinqing, Henaff, Mikael, Zhang, Amy +2 · 2 voices · 5 citations
#Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Robotics (cs.RO)
- Semi-Supervised Offline Reinforcement Learning with Action-Free Trajectories
2022/10/12 by Qinqing Zheng, Mikael Henaff, Zheng, Qinqing +5 · 3 citations
Computer Science · #Reinforcement Learning in Robotics #Machine Learning and Data Classification #Evolutionary Algorithms and Applications
- Minimax Estimation for Personalized Federated Learning: An Alternative between FedAvg and Local Training?
2021/03/02 by Shuxiao Chen, Qinqing Zheng, Chen, Shuxiao +5 · 4 citations
Computer Science · #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Privacy-Preserving Technologies in Data #Stochastic Gradient Optimization Techniques
- Interpolating Convex and Non-Convex Tensor Decompositions via the Subspace Norm
2015/03/18 by Zheng, Qinqing, Tomioka, Ryota · 1 citation
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
- A Convergent Gradient Descent Algorithm for Rank Minimization and Semidefinite Programming from Random Linear Measurements
2015/06/19 by Zheng, Qinqing, Lafferty, John · 1 citation
#FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
- Latent State Marginalization as a Low-cost Approach for Improving Exploration
2022/10/03 by Dinghuai Zhang, Aaron Courville, Zhang, Dinghuai +9 · 2 citations
Computer Science · #Reinforcement Learning in Robotics #Explainable Artificial Intelligence (XAI) #Adversarial Robustness in Machine Learning
- Federated f-Differential Privacy
2021/02/22 by Zheng, Qinqing, Chen, Shuxiao, Long, Qi +1 · 1 citation
#Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #Cryptography and Security (cs.CR) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)