Guo, Weiyang
- MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming
2025/05/22 by Guo, Weiyang, Li, Jing, Wang, Wenya +4 · 7 citations
#Artificial Intelligence (cs.AI) #Cryptography and Security (cs.CR) #FOS: Computer and information sciences
- Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning
2025/06/01 by Wei Guo, Zesheng Shi, Guo, Weiyang +15 · 3 citations
Computer Science · Social Sciences · #Digital and Cyber Forensics #Crime Patterns and Interventions #Artificial Intelligence in Law