Pei, Aihua
- Reinforcement Learning from Multi-role Debates as Feedback for Bias Mitigation in LLMs
2024/04/15 by Cheng, Ruoxi, Ma, Haoxuan, Cao, Shuirong +6 · 9 citations
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences
- KGPA: Robustness Evaluation for Large Language Models via Cross-Domain Knowledge Graphs
2024/06/16 by Aihua Pei, Pei, Aihua, Zehua Yang +9 · 1 citation
Computer Science · #Natural Language Processing Techniques #Topic Modeling
- SelfPrompt: Autonomously Evaluating LLM Robustness via Domain-Constrained Knowledge Guidelines and Refined Adversarial Prompts
2024/12/01 by Aihua Pei, Zehua Yang, Pei, Aihua +7 · 1 citation
Computer Science · #Adversarial Robustness in Machine Learning