vix.ing · top · new · best · stats · spec

Xu, Hainiu

  1. RAID: A Shared Benchmark for Robust Evaluation of Machine-Generated Text Detectors
    2024/05/13 by Liam Dugan, Dugan, Liam, Alyssa Hwang +13 · 29 citations
    Computer Science · #Computation and Language (cs.CL) #FOS: Computer and information sciences #I.2.7 #Natural Language Processing Techniques #Text and Document Classification Technologies #Topic Modeling
  2. OpenToM: A Comprehensive Benchmark for Evaluating Theory-of-Mind Reasoning Capabilities of Large Language Models
    2024/02/08 by Hainiu Xu, Xu, Hainiu, Runcong Zhao +6 · 7 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Topic Modeling
  3. Causal Reasoning of Entities and Events in Procedural Texts
    2023/01/26 by Zhang, Li, Xu, Hainiu, Yang, Yue +4 · 2 citations
    #Computation and Language (cs.CL) #FOS: Computer and information sciences
  4. Towards Unified Task Embeddings Across Multiple Models: Bridging the Gap for Prompt-Based Large Language Models and Beyond
    2024/02/22 by Xinyu Wang, Wang, Xinyu, Hainiu Xu +5 · 1 citation
    Computer Science · #Computation and Language (cs.CL) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning in Healthcare #Natural Language Processing Techniques #Topic Modeling
  5. Calibrating LLMs with Preference Optimization on Thought Trees for Generating Rationale in Science Question Scoring
    2024/06/28 by Li, Jiazheng, Xu, Hainiu, Sun, Zhaoyue +4 · 1 citation
    #Computation and Language (cs.CL) #FOS: Computer and information sciences