Jin, Zhuoran
- Cutting Off the Head Ends the Conflict: A Mechanism for Interpreting and Mitigating Knowledge Conflicts in Language Models
2024/02/28 by Jin, Zhuoran, Cao, Pengfei, Yuan, Hongbang +6 · 17 citations
#Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Information Retrieval (cs.IR)
- RWKU: Benchmarking Real-World Knowledge Unlearning for Large Language Models
2024/06/16 by Zhuoran Jin, Jin, Zhuoran, Pengfei Cao +15 · 17 citations
Computer Science · #Topic Modeling #Natural Language Processing Techniques
- Tug-of-War Between Knowledge: Exploring and Resolving Knowledge Conflicts in Retrieval-Augmented Language Models
2024/02/22 by Zhuoran Jin, Jin, Zhuoran, Pengfei Cao +13 · 13 citations
Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Information Retrieval (cs.IR) #Natural Language Processing Techniques #Topic Modeling
- AgentsCourt: Building Judicial Decision-Making Agents with Court Debate Simulation and Legal Knowledge Augmentation
2024/03/05 by He, Zhitao, Cao, Pengfei, Wang, Chenhao +7 · 9 citations
#Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences
- Focus on Your Question! Interpreting and Mitigating Toxic CoT Problems in Commonsense Reasoning
2024/02/28 by Jiachun Li, Pengfei Cao, Li, Jiachun +13 · 5 citations
Computer Science · Engineering · #Software Engineering Research #Safety Systems Engineering in Autonomy #Software Reliability and Analysis Research
- MIRAGE: Evaluating and Explaining Inductive Reasoning Process in Language Models
2024/10/12 by Li, Jiachun, Cao, Pengfei, Jin, Zhuoran +3 · 6 citations
#Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences
- RAG-RewardBench: Benchmarking Reward Models in Retrieval Augmented Generation for Preference Alignment
2024/12/18 by Zhuoran Jin, Jin, Zhuoran, Hongbang Yuan +11 · 6 citations
Computer Science · #Recommender Systems and Techniques
- Towards Robust Knowledge Unlearning: An Adversarial Framework for Assessing and Improving Unlearning Robustness in Large Language Models
2024/08/20 by Yuan, Hongbang, Jin, Zhuoran, Cao, Pengfei +3 · 5 citations
#Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #Cryptography and Security (cs.CR) #FOS: Computer and information sciences #Machine Learning (cs.LG)
- Unlocking the Future: Exploring Look-Ahead Planning Mechanistic Interpretability in Large Language Models
2024/06/23 by Tianyi Men, Pengfei Cao, Men, Tianyi +9 · 3 citations
Computer Science · #Natural Language Processing Techniques #Topic Modeling
- RULE: Reinforcement UnLEarning Achieves Forget-Retain Pareto Optimality
2025/06/08 by Zhang, Chenlong, Jin, Zhuoran, Yuan, Hongbang +5 · 5 citations
#Computation and Language (cs.CL) #FOS: Computer and information sciences #Machine Learning (cs.LG)
- FinRAGBench-V: A Benchmark for Multimodal RAG with Visual Citation in the Financial Domain
2025/05/23 by Zhao, Suifeng, Jin, Zhuoran, Li, Sujian +1 · 4 citations
#Computation and Language (cs.CL) #FOS: Computer and information sciences
- Agent-RewardBench: Towards a Unified Benchmark for Reward Modeling across Perception, Planning, and Safety in Real-World Multimodal Agents
2025/06/26 by Tianyi Men, Men, Tianyi, Zhuoran Jin +9 · 5 citations
Computer Science · Psychology · #Advanced Text Analysis Techniques #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Human-Automation Interaction and Safety #Multi-Agent Systems and Negotiation
- CITI: Enhancing Tool Utilizing Ability in Large Language Models without Sacrificing General Performance
2024/09/20 by Yupu Hao, Hao, Yupu, Pengfei Cao +11 · 2 citations
Computer Science · #Computation and Language (cs.CL) #FOS: Computer and information sciences #Natural Language Processing Techniques #Topic Modeling
- MMR-V: What's Left Unsaid? A Benchmark for Multimodal Deep Reasoning in Videos
2025/06/04 by Kejian Zhu, Zhuoran Jin, Zhu, Kejian +15 · 5 citations
Computer Science · #Multimodal Machine Learning Applications #Explainable Artificial Intelligence (XAI) #Topic Modeling
- A Troublemaker with Contagious Jailbreak Makes Chaos in Honest Towns
2024/10/21 by Tianyi Men, Men, Tianyi, Pengfei Cao +9 · 1 citation
Social Sciences · #Computation and Language (cs.CL) #Crime Patterns and Interventions #Crime, Illicit Activities, and Governance #FOS: Computer and information sciences