Qiu, Tianyi
- PKU-SafeRLHF: Towards Multi-Level Safety Alignment for LLMs with Human Preference
2024/06/20 by Jiaming Ji, Ji, Jiaming, Donghai Hong +16 · 53 citations
Computer Science · #Natural Language Processing Techniques #Software Engineering Research
- AI Alignment: A Comprehensive Survey
2023/10/30 by Ji, Jiaming, Qiu, Tianyi, Chen, Boyuan +23 · 41 citations
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences
- Aligner: Efficient Alignment by Learning to Correct
2024/02/04 by Jiaming Ji, Ji, Jiaming, Boyuan Chen +13 · 27 citations
Computer Science · Physics and Astronomy · #Handwritten Text Recognition Techniques #Color Science and Applications
- Language Models Resist Alignment: Evidence From Data Compression
2024/06/10 by Jiaming Ji, Kaile Wang, Ji, Jiaming +14 · 13 citations
Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Natural Language Processing Techniques
- Align Anything: Training All-Modality Models to Follow Instructions with Language Feedback
2024/12/20 by Jiaming Ji, Jiayi Zhou, Ji, Jiaming +34 · 9 citations
Computer Science · #Intelligent Tutoring Systems and Adaptive Learning #Speech and dialogue systems #Natural Language Processing Techniques
- Auditing Black-Box LLM APIs with a Rank-Based Uniformity Test
2025/06/08 by Zhu, Xiaoyuan, Ye, Yaowen, Qiu, Tianyi +6 · 6 citations
#Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #Cryptography and Security (cs.CR) #FOS: Computer and information sciences
- Reward Generalization in RLHF: A Topological Perspective
2024/02/15 by Qiu, Tianyi, Zeng, Fanzhi, Ji, Jiaming +7 · 2 citations
#Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #Discrete Mathematics (cs.DM) #FOS: Computer and information sciences #Machine Learning (cs.LG)
- Representative Social Choice: From Learning Theory to AI Alignment
2024/10/31 by Tianyi Qiu, Qiu, Tianyi · 1 voice · 1 citation
Social Sciences · #Ethics and Social Impacts of AI