vix.ing · top · new · best · stats · spec

Xiao, Jiancong

  1. On the Algorithmic Bias of Aligning Large Language Models with RLHF: Preference Collapse and Matching Regularization
    2024/05/26 by Xiao, Jiancong, Li, Ziniu, Xie, Xingyu +4 · 14 citations
    #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Methodology (stat.ME)
  2. Preserving Diversity in Supervised Fine-Tuning of Large Language Models
    2024/08/29 by Ziniu Li, Congliang Chen, Li, Ziniu +11 · 15 citations
    Physics and Astronomy · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Magnetic confinement fusion research
  3. Stability Analysis and Generalization Bounds of Adversarial Training
    2022/10/03 by Jiancong Xiao, Yanbo Fan, Xiao, Jiancong +7 · 5 citations
    Computer Science · #Adversarial Robustness in Machine Learning #Advanced Neural Network Applications #Domain Adaptation and Few-Shot Learning
  4. Adversarial Rademacher Complexity of Deep Neural Networks
    2022/11/27 by Jiancong Xiao, Yanbo Fan, Xiao, Jiancong +5 · 3 citations
    Computer Science · #Adversarial Robustness in Machine Learning #Advanced Neural Network Applications #Anomaly Detection Techniques and Applications
  5. Statistical Impossibility and Possibility of Aligning LLMs with Human Preferences: From Condorcet Paradox to Nash Equilibrium
    2025/03/14 by Kaizhao Liu, Qi Long, Liu, Kaizhao +7 · 1 voice · 2 citations
    #cs.GT #cs.LG #econ.TH #math.ST #stat.ML
  6. Magnetic Preference Optimization: Achieving Last-iterate Convergence for Language Model Alignment
    2024/10/22 by Mingzhi Wang, Wang, Mingzhi, Chengdong Ma +17 · 2 citations
    Computer Science · #Computation and Language (cs.CL) #FOS: Computer and information sciences #Natural Language Processing Techniques #Speech and dialogue systems #Topic Modeling
  7. Adaptive Smoothness-weighted Adversarial Training for Multiple Perturbations with Its Stability Analysis
    2022/10/02 by Jiancong Xiao, Zeyu Qin, Xiao, Jiancong +9 · 1 citation
    Computer Science · #Adversarial Robustness in Machine Learning #FOS: Computer and information sciences #Machine Learning (cs.LG)
  8. Restoring Calibration for Aligned Large Language Models: A Calibration-Aware Fine-Tuning Approach
    2025/05/04 by Xiao, Jiancong, Zhanliang Wang, Hou, Bojian +9 · 5 citations
    Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Natural Language Processing Techniques #Topic Modeling
  9. Understanding Adversarial Robustness Against On-manifold Adversarial Examples
    2022/10/02 by Jiancong Xiao, Liusha Yang, Xiao, Jiancong +7 · 1 citation
    Computer Science · #Advanced Neural Network Applications #Adversarial Robustness in Machine Learning #Cryptography and Security (cs.CR) #Explainable Artificial Intelligence (XAI) #FOS: Computer and information sciences #Machine Learning (cs.LG)