vix.ing · top · new · best · stats · spec

Dale Schuurmans

  1. BNAI, NO-TOKEN, and MIND-UNITY: Pillars of a Systemic Revolution in Artificial Intelligence
    2022/01/28 by Jason Wei, Xuezhi Wang, Wei, Jason +17 · 18 voices · 2519 citations
    Computer Science · #Natural Language Processing Techniques #Text Readability and Simplification #Topic Modeling #cs.AI #cs.CL
  2. Self-Consistency Improves Chain of Thought Reasoning in Language Models
    2022/03/21 by Xuezhi Wang, Wang, Xuezhi, Dale Schuurmans +9 · 1078 citations
    Computer Science · #Topic Modeling #Natural Language Processing Techniques #Advanced Graph Neural Networks
  3. SFT Memorizes, RL Generalizes: A Comparative Study of Foundation Model Post-training
    2025/01/28 by Tianzhe Chu, Chu, Tianzhe, Yuexiang Zhai +15 · 7 voices · 246 citations
    Computer Science · #Multimodal Machine Learning Applications #Topic Modeling #Domain Adaptation and Few-Shot Learning
  4. What learning algorithm is in-context learning? Investigations with linear models
    2022/11/28 by Ekin Akyürek, Akyürek, Ekin, Dale Schuurmans +7 · 3 voices · 77 citations
    Computer Science · #Neural Networks and Applications #cs.CL #cs.LG
  5. Evolving Deeper LLM Thinking
    2025/01/17 by Kuang-Huei Lee, Lee, Kuang-Huei, Ian Fischer +12 · 10 voices · 15 citations
    Computer Science · Social Sciences · #Artificial Intelligence in Law #Digital Rights Management and Security #Law, AI, and Intellectual Property #cs.AI
  6. Least-to-Most Prompting Enables Complex Reasoning in Large Language Models
    2022/05/21 by Denny Zhou, Nathanael Schärli, Zhou, Denny +18 · 184 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Natural Language Processing Techniques #Text Readability and Simplification #Topic Modeling
  7. Learning Universal Policies via Text-Guided Video Generation
    2023/01/31 by Yilun Du, Du, Yilun, Mengjiao Yang +13 · 101 citations
    Computer Science · #Multimodal Machine Learning Applications #Natural Language Processing Techniques
  8. Memory Augmented Large Language Models are Computationally Universal
    2023/01/10 by Dale Schuurmans, Schuurmans, Dale · 6 voices · 5 citations
    Computer Science · #Algorithms and Data Compression #Computation and Language (cs.CL) #FOS: Computer and information sciences #Formal Languages and Automata Theory (cs.FL) #Natural Language Processing Techniques #Topic Modeling #cs.CL #cs.FL
  9. Bridging the Gap Between Value and Policy Based Reinforcement Learning
    2017/02/28 by Ofir Nachum, Nachum, Ofir, Mohammad Norouzi +5 · 60 citations
    Computer Science · #Reinforcement Learning in Robotics
  10. Learning Interactive Real-World Simulators
    2023/10/09 by Yang, Sherry, Yilun Du, Kamyar Ghasemipour +9 · 76 citations
    Computer Science · Psychology · Engineering · #Intelligent Tutoring Systems and Adaptive Learning #Educational Games and Gamification #Human Motion and Animation
  11. On the Global Convergence Rates of Softmax Policy Gradient Methods
    2020/05/13 by Jincheng Mei, Mei, Jincheng, Chenjun Xiao +5 · 24 citations
    Computer Science · Decision Sciences · #Stochastic Gradient Optimization Techniques #Reinforcement Learning in Robotics #Advanced Bandit Algorithms Research
  12. Reward Augmented Maximum Likelihood for Neural Structured Prediction
    2016/09/01 by Mohammad Norouzi, Norouzi, Mohammad, Samy Bengio +11 · 12 citations
    Computer Science · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multimodal Machine Learning Applications #Natural Language Processing Techniques #Topic Modeling
  13. GenDICE: Generalized Offline Estimation of Stationary Values
    2020/02/21 by Ruiyi Zhang, Zhang, Ruiyi, Bo Dai +5 · 19 citations
    Computer Science · Decision Sciences · #Reinforcement Learning in Robotics #Advanced Bandit Algorithms Research #Machine Learning and Algorithms
  14. Video as the New Language for Real-World Decision Making
    2024/02/27 by Sherry Yang, Yang, Sherry, Jacob Walker +13 · 17 citations
    Social Sciences · #Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Multimedia Communication and Technology
  15. Learning with a Strong Adversary
    2015/11/10 by Ruitong Huang, Bing Xu, Huang, Ruitong +5 · 10 citations
    Computer Science · #Adversarial Robustness in Machine Learning #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Machine Learning (cs.LG)
  16. Scalable Diffusion for Materials Generation
    2023/10/18 by KwangHwan Cho, Yang, Sherry, Amil Merchant +10 · 15 citations
    Materials Science · Computer Science · #Machine Learning in Materials Science #Topic Modeling
  17. Trust-PCL: An Off-Policy Trust Region Method for Continuous Control
    2017/07/06 by Ofir Nachum, Nachum, Ofir, Mohammad Norouzi +5 · 10 citations
    Computer Science · #Reinforcement Learning in Robotics #Advanced Multi-Objective Optimization Algorithms #Evolutionary Algorithms and Applications
  18. Value-Incentivized Preference Optimization: A Unified Approach to Online and Offline RLHF
    2024/05/29 by Shicong Cen, Jincheng Mei, Cen, Shicong +15 · 16 citations
    Engineering · #Advanced Manufacturing and Logistics Optimization #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Scheduling and Optimization Algorithms #Vehicle Routing Optimization Methods
  19. Autoregressive Large Language Models are Computationally Universal
    2024/10/04 by Dale Schuurmans, Schuurmans, Dale, Hanjun Dai +3 · 4 voices · 3 citations
    #cs.CL
  20. Chain of Thought Imitation with Procedure Cloning
    2022/05/22 by Mengjiao Yang, Yang, Mengjiao, Dale Schuurmans +5 · 8 citations
    Computer Science · #Reinforcement Learning in Robotics #AI-based Problem Solving and Planning #Machine Learning and Algorithms
  21. Foundation Models for Decision Making: Problems, Methods, and Opportunities
    2023/03/07 by Sherry Yang, Ofir Nachum, Yang, Sherry +8 · 9 citations
    Computer Science · Psychology · #Artificial Intelligence (cs.AI) #Explainable Artificial Intelligence (XAI) #FOS: Computer and information sciences #Human-Automation Interaction and Safety #Machine Learning (cs.LG) #Multimodal Machine Learning Applications
  22. Gradient-Free Structured Pruning with Unlabeled Data
    2023/03/07 by Azade Nova, Nova, Azade, Hanjun Dai +3 · 8 citations
    Computer Science · #Topic Modeling #Natural Language Processing Techniques #Speech Recognition and Synthesis
  23. Combiner: Full Attention Transformer with Sparse Computation Cost
    2021/07/12 by Hongyu Ren, Ren, Hongyu, Hanjun Dai +11 · 6 citations
    Computer Science · #Topic Modeling #Multimodal Machine Learning Applications #Advanced Graph Neural Networks
  24. TEMPERA: Test-Time Prompting via Reinforcement Learning
    2022/11/21 by Tianjun Zhang, Zhang, Tianjun, Xuezhi Wang +7 · 7 citations
    Computer Science · #Topic Modeling #Multimodal Machine Learning Applications #Natural Language Processing Techniques
  25. Scalable Deep Generative Modeling for Sparse Graphs
    2020/06/28 by Hanjun Dai, Dai, Hanjun, Azade Nazi +7 · 5 citations
    Computer Science · #Advanced Graph Neural Networks #FOS: Computer and information sciences #Graph Theory and Algorithms #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Topic Modeling
  26. Multimodal Masked Autoencoders Learn Transferable Representations
    2022/05/27 by Xinyang Geng, Hao Líu, Geng, Xinyang +9 · 5 citations
    Biochemistry, Genetics and Molecular Biology · Computer Science · #Cancer-related molecular mechanisms research #Computer Vision and Pattern Recognition (cs.CV) #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Multimodal Machine Learning Applications
  27. An Optimistic Perspective on Offline Reinforcement Learning
    2019/07/10 by Rishabh Agarwal, Dale Schuurmans, Mohammad Norouzi · 1 voice
    #cs.LG #cs.AI #stat.ML
  28. Directions of Curvature as an Explanation for Loss of Plasticity
    2023/11/30 by Alex Lewandowski, Haruto Tanaka, Lewandowski, Alex +5 · 6 citations
    Medicine · #Medical and Biological Sciences #Spine and Intervertebral Disc Pathology
  29. Rationale-Augmented Ensembles in Language Models
    2022/07/02 by Xuezhi Wang, Wang, Xuezhi, Dale Schuurmans +8 · 4 citations
    Computer Science · #Topic Modeling #Explainable Artificial Intelligence (XAI) #Advanced Text Analysis Techniques
  30. Learning Continually by Spectral Regularization
    2024/06/10 by Alex Lewandowski, Lewandowski, Alex, Saurabh Kumar +9 · 7 citations
    Computer Science · #FOS: Computer and information sciences #Face and Expression Recognition #Machine Learning (cs.LG) #Neural Networks and Applications
  31. Spectral Decomposition Representation for Reinforcement Learning
    2022/08/19 by Tongzheng Ren, Ren, Tongzheng, Tianjun Zhang +9 · 4 citations
    Computer Science · Physics and Astronomy · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Model Reduction and Neural Networks #Reinforcement Learning in Robotics
  32. Making Linear MDPs Practical via Contrastive Representation Learning
    2022/07/14 by Tianjun Zhang, Tongzheng Ren, Zhang, Tianjun +9 · 4 citations
    Computer Science · Engineering · #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #Sparse and Compressive Sensing Techniques
  33. Variational Rejection Sampling
    2018/04/05 by Aditya Grover, Grover, Aditya, Miguel Lázaro-Gredilla +6 · 2 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Gaussian Processes and Bayesian Inference #Generative Adversarial Networks and Image Synthesis #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Neural and Evolutionary Computing (cs.NE)
  34. The Role of Baselines in Policy Gradient Optimization
    2023/01/16 by Jincheng Mei, Wesley Chung, Mei, Jincheng +9 · 3 citations
    Computer Science · Economics, Econometrics and Finance · Mathematics · #Artificial Intelligence (cs.AI) #Economic Policies and Impacts #FOS: Computer and information sciences #Machine Learning (cs.LG) #Markov Chains and Monte Carlo Methods #Stochastic Gradient Optimization Techniques
  35. Leveraging Non-uniformity in First-order Non-convex Optimization
    2021/05/13 by Jincheng Mei, Yue Gao, Mei, Jincheng +7 · 3 citations
    Computer Science · Decision Sciences · Engineering · #Advanced Bandit Algorithms Research #FOS: Computer and information sciences #Machine Learning (cs.LG) #Sparse and Compressive Sensing Techniques #Stochastic Gradient Optimization Techniques
  36. On the Optimality of Batch Policy Optimization Algorithms
    2021/04/06 by Chenjun Xiao, Yifan Wu, Xiao, Chenjun +13 · 2 citations
    Computer Science · Engineering · #Advanced Manufacturing and Logistics Optimization #FOS: Computer and information sciences #Machine Learning (cs.LG) #Optimization and Search Problems #Scheduling and Optimization Algorithms
  37. Generative Hierarchical Materials Search
    2024/09/10 by Sherry Yang, Simon Batzner, Yang, Sherry +17 · 5 citations
    Engineering · Materials Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #FOS: Physical sciences #Machine Learning in Materials Science #Manufacturing Process and Optimization #Materials Science (cond-mat.mtrl-sci)
  38. Go Wide, Then Narrow: Efficient Training of Deep Thin Networks
    2020/07/01 by Denny Zhou, Zhou, Denny, Mao Ye +15 · 2 citations
    Computer Science · Neuroscience · #Brain Tumor Detection and Classification #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and ELM #Stochastic Gradient Optimization Techniques
  39. Toward Understanding In-context vs. In-weight Learning
    2024/10/30 by Bryan Chan, Xinyi Chen, Chan, Bryan +5 · 4 citations
    Health Professions · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Physical Education and Pedagogy
  40. Off-Policy Evaluation via the Regularized Lagrangian
    2020/07/07 by Mengjiao Yang, Ofir Nachum, Yang, Mengjiao +7 · 1 citation
    Computer Science · Decision Sciences · Mathematics · #Advanced Causal Inference Techniques #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Control (math.OC) #Probabilistic and Robust Engineering Design #Software Reliability and Analysis Research
  41. Discrete Langevin Sampler via Wasserstein Gradient Flow
    2022/06/29 by Haoran Sun, Hanjun Dai, Sun, Haoran +7 · 1 citation
    Computer Science · Mathematics · Medicine · #Advanced Neuroimaging Techniques and Applications #FOS: Computer and information sciences #Machine Learning (cs.LG) #Markov Chains and Monte Carlo Methods #Topological and Geometric Data Analysis
  42. Probabilistic Adaptation of Text-to-Video Models
    2023/06/02 by Mengjiao Yang, Yilun Du, Yang, Mengjiao +9 · 1 citation
    Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Multimodal Machine Learning Applications #Natural Language Processing Techniques #Topic Modeling
  43. Faster WIND: Accelerating Iterative Best-of-N Distillation for LLM Alignment
    2024/10/28 by Tong Yang, Yang, Tong, Jincheng Mei +12 · 1 citation
    Engineering · #Advanced Control Systems Optimization #FOS: Computer and information sciences #Fault Detection and Control Systems #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reservoir Engineering and Simulation Methods
  44. Soft Preference Optimization: Aligning Language Models to Expert Distributions
    2024/04/30 by Arsalan Sharifnassab, Saber Salehkaleybar, Sharifnassab, Arsalan +7 · 1 citation
    Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Semantic Web and Ontologies
  45. Latent Variable Representation for Reinforcement Learning
    2022/12/17 by Tongzheng Ren, Ren, Tongzheng, Chenjun Xiao +13 · 1 citation
    Computer Science · #Reinforcement Learning in Robotics