Hainiu Xu
- RAID: A Shared Benchmark for Robust Evaluation of Machine-Generated Text Detectors
2024/05/13 by Liam Dugan, Alyssa Hwang, Dugan, Liam +13 · 29 citations
Computer Science · #Computation and Language (cs.CL) #FOS: Computer and information sciences #I.2.7 #Natural Language Processing Techniques #Text and Document Classification Technologies #Topic Modeling
- OpenToM: A Comprehensive Benchmark for Evaluating Theory-of-Mind Reasoning Capabilities of Large Language Models
2024/02/08 by Hainiu Xu, Xu, Hainiu, Runcong Zhao +6 · 7 citations
Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Topic Modeling
- Towards Unified Task Embeddings Across Multiple Models: Bridging the Gap for Prompt-Based Large Language Models and Beyond
2024/02/22 by Xinyu Wang, Hainiu Xu, Wang, Xinyu +5 · 1 citation
Computer Science · #Computation and Language (cs.CL) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning in Healthcare #Natural Language Processing Techniques #Topic Modeling