vix.ing · top · new · best · stats · spec

Hainiu Xu

  1. RAID: A Shared Benchmark for Robust Evaluation of Machine-Generated Text Detectors
    2024/05/13 by Liam Dugan, Alyssa Hwang, Dugan, Liam +13 · 29 citations
    Computer Science · #Computation and Language (cs.CL) #FOS: Computer and information sciences #I.2.7 #Natural Language Processing Techniques #Text and Document Classification Technologies #Topic Modeling
  2. OpenToM: A Comprehensive Benchmark for Evaluating Theory-of-Mind Reasoning Capabilities of Large Language Models
    2024/02/08 by Hainiu Xu, Xu, Hainiu, Runcong Zhao +6 · 7 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Topic Modeling
  3. Towards Unified Task Embeddings Across Multiple Models: Bridging the Gap for Prompt-Based Large Language Models and Beyond
    2024/02/22 by Xinyu Wang, Hainiu Xu, Wang, Xinyu +5 · 1 citation
    Computer Science · #Computation and Language (cs.CL) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning in Healthcare #Natural Language Processing Techniques #Topic Modeling