vix.ing · top · new · best · stats · spec

Yu Bai

  1. Negative Preference Optimization: From Catastrophic Collapse to Effective Unlearning
    2024/04/08 by Ruiqi Zhang, Licong Lin, Zhang, Ruiqi +5 · 81 citations
    Computer Science · #Advanced Neural Network Applications #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #Explainable Artificial Intelligence (XAI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Data Classification
  2. Transformers as Statisticians: Provable In-Context Learning with In-Context Algorithm Selection
    2023/06/07 by Yu Bai, Fan Chen, Bai, Yu +7 · 1 voice · 37 citations
    Computer Science · #Adversarial Robustness in Machine Learning #Anomaly Detection Techniques and Applications #Explainable Artificial Intelligence (XAI) #cs.AI #cs.CL #cs.LG #math.ST #stat.ML
  3. OpenAI GPT-5 System Card
    2025/12/19 by Aaditya Singh, Adam Fry, Adam Perelman +483 · 2 voices · 36 citations
    #cs.CL #cs.AI
  4. The International Linear Collider: Report to Snowmass 2021
    2022/03/15 by A. Aryshev, Aryshev, Alexander, T. Behnke +608 · 13 citations
    Engineering · Physics and Astronomy · Social Sciences · #Accelerator Physics (physics.acc-ph) #Experimental and Theoretical Physics Studies #FOS: Physical sciences #High Energy Physics - Experiment (hep-ex) #High Energy Physics - Phenomenology (hep-ph) #International Science and Diplomacy #Particle Accelerators and Free-Electron Lasers
  5. The Landscape of Empirical Risk for Non-convex Losses
    2016/07/22 by Yu Bai, Mei, Song, Andrea Montanari +2 · 10 citations
    Computer Science · Engineering · Mathematics · #FOS: Computer and information sciences #Machine Learning (stat.ML) #Machine Learning and Algorithms #Sparse and Compressive Sensing Techniques #Statistical Methods and Inference
  6. Policy Finetuning: Bridging Sample-Efficient Offline and Online Reinforcement Learning
    2021/06/09 by Tengyang Xie, Nan Jiang, Xie, Tengyang +7 · 10 citations
    Computer Science · #Reinforcement Learning in Robotics #Adversarial Robustness in Machine Learning #Machine Learning and Algorithms
  7. Beyond Linearization: On Quadratic and Higher-Order Approximation of Wide Neural Networks
    2019/10/03 by Yu Bai, Bai, Yu, Jason D. Lee +1 · 12 citations
    Computer Science · #Stochastic Gradient Optimization Techniques #Neural Networks and Applications #Domain Adaptation and Few-Shot Learning
  8. Subgradient Descent Learns Orthogonal Dictionaries
    2018/10/25 by Yu Bai, Qijia Jiang, Bai, Yu +3 · 6 citations
    Computer Science · Engineering · #Blind Source Separation Techniques #FOS: Computer and information sciences #FOS: Mathematics #Information Theory (cs.IT) #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Optimization and Control (math.OC) #Sparse and Compressive Sensing Techniques #Stochastic Gradient Optimization Techniques
  9. ProxQuant: Quantized Neural Networks via Proximal Operators
    2018/10/01 by Yu Bai, Yu-Xiang Wang, Bai, Yu +3 · 6 citations
    Computer Science · Engineering · #Advanced Neural Network Applications #Domain Adaptation and Few-Shot Learning #Sparse and Compressive Sensing Techniques
  10. Transformers as Decision Makers: Provable In-Context Reinforcement Learning via Supervised Pretraining
    2023/10/12 by Licong Lin, Lin, Licong, Yu Bai +3 · 9 citations
    Computer Science · Decision Sciences · #Reinforcement Learning in Robotics #Advanced Bandit Algorithms Research #Distributed Sensor Networks and Detection Algorithms
  11. Provable Self-Play Algorithms for Competitive Reinforcement Learning
    2020/02/10 by Yu Bai, Chi Jin, Bai, Yu +1 · 5 citations
    Computer Science · Decision Sciences · Engineering · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Scheduling and Optimization Algorithms
  12. How Do Transformers Learn In-Context Beyond Simple Functions? A Case Study on Learning with Representations
    2023/10/16 by Tianyu Guo, Wei Hu, Guo, Tianyu +10 · 7 citations
    Computer Science · #Topic Modeling #Natural Language Processing Techniques #Speech Recognition and Synthesis
  13. When Can We Learn General-Sum Markov Games with a Large Number of Players Sample-Efficiently?
    2021/10/08 by Ziang Song, Mei Song, Song, Ziang +3 · 4 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Computer Science and Game Theory (cs.GT) #FOS: Computer and information sciences #Game Theory and Applications #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics
  14. Dual blockade of IL‐4 and IL‐13 with dupilumab, an IL‐4Rα antibody, is required to broadly inhibit type 2 inflammation
    2019/12/15 by Audrey Le Floc’h, Jeanne Allinne, Kirsten Nagashima +21 · 3 citations
    Immunology and Microbiology · Medicine · #Asthma and respiratory diseases #Dermatology and Skin Diseases #Psoriasis: Treatment and Pathogenesis
  15. Efficient and Differentiable Conformal Prediction with General Function Classes
    2022/02/22 by Yu Bai, Bai, Yu, Mei, Song +6 · 2 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #Machine Learning and Data Classification #Methodology (stat.ME) #Statistics Theory (math.ST)
  16. Efficient Phi-Regret Minimization in Extensive-Form Games via Online Mirror Descent
    2022/05/30 by Yu Bai, Chi Jin, Bai, Yu +6 · 2 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Auction Theory and Applications #Computer Science and Game Theory (cs.GT) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics
  17. Lower Bounds for Learning in Revealing POMDPs
    2023/02/02 by Fan Chen, Huan Wang, Chen, Fan +6 · 2 citations
    Computer Science · Decision Sciences · #Advanced Bandit Algorithms Research #Bayesian Modeling and Causal Inference #FOS: Computer and information sciences #FOS: Mathematics #Information Theory (cs.IT) #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #Statistics Theory (math.ST)
  18. MMRA: A Benchmark for Evaluating Multi-Granularity and Multi-Image Relational Association Capabilities in Large Visual Language Models
    2024/07/24 by Siwei Wu, Kang Zhu, Wu, Siwei +23 · 3 citations
    Computer Science · #Computation and Language (cs.CL) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Multimodal Machine Learning Applications
  19. Movable Antenna-Equipped UAV for Data Collection in Backscatter Sensor Networks: A Deep Reinforcement Learning-based Approach
    2024/11/21 by Yu Bai, Boxuan Xie, Bai, Yu +6 · 4 citations
    Engineering · #Energy Harvesting in Wireless Networks #FOS: Computer and information sciences #FOS: Electrical engineering #Indoor and Outdoor Localization Technologies #Machine Learning (cs.LG) #Signal Processing (eess.SP) #UAV Applications and Optimization #electronic engineering #information engineering
  20. Near-Optimal Provable Uniform Convergence in Offline Policy Evaluation for Reinforcement Learning
    2020/07/07 by Minghao Yin, Yin, Ming, Yu Bai +3 · 5 citations
    Computer Science · Decision Sciences · #Reinforcement Learning in Robotics #Machine Learning and Algorithms #Advanced Bandit Algorithms Research
  21. How Important is the Train-Validation Split in Meta-Learning?
    2020/10/12 by Yu Bai, Minshuo Chen, Bai, Yu +13 · 2 citations
    Computer Science · Engineering · #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Data Classification #Sparse and Compressive Sensing Techniques
  22. Provably Efficient Q-Learning with Low Switching Cost
    2019/05/30 by Yu Bai, Bai, Yu, Tengyang Xie +5 · 1 citation
    Computer Science · Decision Sciences · Engineering · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #Blind Source Separation Techniques #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Sparse and Compressive Sensing Techniques
  23. Exact Gap between Generalization Error and Uniform Convergence in Random\n Feature Models
    2021/03/08 by Zitong Yang, Yang, Zitong, Yu Bai +2 · 1 citation
    Computer Science · #Stochastic Gradient Optimization Techniques #Advanced Neural Network Applications #Machine Learning and Algorithms
  24. Don't Just Blame Over-parametrization for Over-confidence: Theoretical Analysis of Calibration in Binary Classification
    2021/02/15 by Yu Bai, Bai, Yu, Huan Wang +4 · 1 citation
    Computer Science · #Adversarial Robustness in Machine Learning #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #Machine Learning and Data Classification #Statistics Theory (math.ST)
  25. Near-Optimal Offline Reinforcement Learning via Double Variance\n Reduction
    2021/02/02 by Minghao Yin, Yin, Ming, Yu Bai +3 · 5 citations
    Computer Science · #Adversarial Robustness in Machine Learning #Age of Information Optimization #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics
  26. Near-Optimal Learning of Extensive-Form Games with Imperfect Information
    2022/02/03 by Yu Bai, Chi Jin, Bai, Yu +4 · 1 citation
    Decision Sciences · #Advanced Bandit Algorithms Research #Auction Theory and Applications #Game Theory and Applications
  27. Partially Observable RL with B-Stability: Unified Structural Condition and Sharp Sample-Efficient Algorithms
    2022/09/29 by Fan Chen, Yu Bai, Chen, Fan +2 · 1 citation
    Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Reinforcement Learning in Robotics #Statistics Theory (math.ST)
  28. Enhanced grain refinement and mechanical properties of AZ91 alloy by a novel Al-5.1 V-2.3B refiner containing VB2 and VB particles
    2022/12/07 by Wenxue Fan, Yu Bai, Guoliang Zuo +1 · 1 citation
    Engineering · Materials Science · #Aluminum Alloys Composites Properties #Magnesium Alloys: Properties and Applications #Aluminum Alloy Microstructure Properties
  29. Text2Data: Low-Resource Data Generation with Textual Control
    2024/02/08 by Shiyu Wang, Yihao Feng, Wang, Shiyu +15 · 1 citation
    Computer Science · #Semantic Web and Ontologies #Natural Language Processing Techniques
  30. Use of Low-Titer O-Positive Whole Blood in Female Trauma Patients: A Literature Review, Qualitative Multidisciplinary Analysis of Risk/Benefit, and Guidelines for Its Use as a Universal Product in Hemorrhagic Shock
    2023/11/06 by Thomas W Clements, Thomas W. Clements, Jan‐Michael Van Gent +11 · 1 citation
    Medicine · #Blood groups and transfusion #Blood transfusion and management #Trauma, Hemostasis, Coagulopathy, Resuscitation
  31. How Far Can In-Context Alignment Go? Exploring the State of In-Context Alignment
    2024/06/17 by Heyan Huang, Yinghao Li, Huang, Heyan +7 · 1 citation
    Decision Sciences · #Big Data Technologies and Applications
  32. Dynamic Temperature Knowledge Distillation
    2024/04/19 by Yukang Wei, Wei, Yukang, Yu Bai +1 · 1 citation
    Computer Science · #Neural Networks and Applications
  33. Offline Learning in Markov Games with General Function Approximation
    2023/02/06 by Yuheng Zhang, Zhang, Yuheng, Yu Bai +3 · 1 citation
    Computer Science · Decision Sciences · Energy · #Advanced Bandit Algorithms Research #Artificial Intelligence (cs.AI) #Energy, Environment, and Transportation Policies #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Multiagent Systems (cs.MA) #Reinforcement Learning in Robotics
  34. Taylorized Training: Towards Better Approximation of Neural Network Training at Finite Width
    2020/02/10 by Yu Bai, Ben Krause, Bai, Yu +7 · 1 citation
    Computer Science · Physics and Astronomy · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Model Reduction and Neural Networks #Neural Networks and Applications #Stochastic Gradient Optimization Techniques
  35. SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization
    2025/05/16 by Huashan Sun, Sun, Huashan, Shengyi Liao +18 · 2 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Multimodal Machine Learning Applications #Topic Modeling