Xiao, Jiancong
- On the Algorithmic Bias of Aligning Large Language Models with RLHF: Preference Collapse and Matching Regularization
2024/05/26 by Xiao, Jiancong, Li, Ziniu, Xie, Xingyu +4 · 14 citations
#FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Methodology (stat.ME)
- Preserving Diversity in Supervised Fine-Tuning of Large Language Models
2024/08/29 by Ziniu Li, Congliang Chen, Li, Ziniu +11 · 15 citations
Physics and Astronomy · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Magnetic confinement fusion research
- Stability Analysis and Generalization Bounds of Adversarial Training
2022/10/03 by Jiancong Xiao, Yanbo Fan, Xiao, Jiancong +7 · 5 citations
Computer Science · #Adversarial Robustness in Machine Learning #Advanced Neural Network Applications #Domain Adaptation and Few-Shot Learning
- Adversarial Rademacher Complexity of Deep Neural Networks
2022/11/27 by Jiancong Xiao, Yanbo Fan, Xiao, Jiancong +5 · 3 citations
Computer Science · #Adversarial Robustness in Machine Learning #Advanced Neural Network Applications #Anomaly Detection Techniques and Applications
- Statistical Impossibility and Possibility of Aligning LLMs with Human Preferences: From Condorcet Paradox to Nash Equilibrium
2025/03/14 by Kaizhao Liu, Qi Long, Liu, Kaizhao +7 · 1 voice · 2 citations
#cs.GT #cs.LG #econ.TH #math.ST #stat.ML
- Magnetic Preference Optimization: Achieving Last-iterate Convergence for Language Model Alignment
2024/10/22 by Mingzhi Wang, Wang, Mingzhi, Chengdong Ma +17 · 2 citations
Computer Science · #Computation and Language (cs.CL) #FOS: Computer and information sciences #Natural Language Processing Techniques #Speech and dialogue systems #Topic Modeling
- Adaptive Smoothness-weighted Adversarial Training for Multiple Perturbations with Its Stability Analysis
2022/10/02 by Jiancong Xiao, Zeyu Qin, Xiao, Jiancong +9 · 1 citation
Computer Science · #Adversarial Robustness in Machine Learning #FOS: Computer and information sciences #Machine Learning (cs.LG)
- Restoring Calibration for Aligned Large Language Models: A Calibration-Aware Fine-Tuning Approach
2025/05/04 by Xiao, Jiancong, Zhanliang Wang, Hou, Bojian +9 · 5 citations
Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Natural Language Processing Techniques #Topic Modeling
- Understanding Adversarial Robustness Against On-manifold Adversarial Examples
2022/10/02 by Jiancong Xiao, Liusha Yang, Xiao, Jiancong +7 · 1 citation
Computer Science · #Advanced Neural Network Applications #Adversarial Robustness in Machine Learning #Cryptography and Security (cs.CR) #Explainable Artificial Intelligence (XAI) #FOS: Computer and information sciences #Machine Learning (cs.LG)