vix.ing · top · new · best · stats · spec

Seungone Kim

  1. Prometheus: Inducing Fine-grained Evaluation Capability in Language Models
    2023/10/12 by Seungone Kim, Jamin Shin, Kim, Seungone +19 · 91 citations
    Computer Science · #Topic Modeling #Natural Language Processing Techniques #Text Readability and Simplification
  2. Language Models as Compilers: Simulating Pseudocode Execution Improves Algorithmic Reasoning in Language Models
    2024/04/03 by Hyungjoo Chae, Chae, Hyungjoo, Yeonghyeon Kim +20 · 1 voice · 2 citations
    Computer Science · #Model-Driven Software Engineering Techniques
  3. The CoT Collection: Improving Zero-shot and Few-shot Learning of Language Models via Chain-of-Thought Fine-Tuning
    2023/05/23 by Seungone Kim, Se June Joo, Kim, Seungone +11 · 24 citations
    Computer Science · Materials Science · Medicine · #Artificial Intelligence (cs.AI) #Artificial Intelligence in Healthcare and Education #Computation and Language (cs.CL) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning in Materials Science #Topic Modeling
  4. FLASK: Fine-grained Language Model Evaluation based on Alignment Skill Sets
    2023/07/20 by Seonghyeon Ye, Doyoung Kim, Ye, Seonghyeon +15 · 24 citations
    Computer Science · #Topic Modeling #Natural Language Processing Techniques #Text Readability and Simplification
  5. Prometheus-Vision: Vision-Language Model as a Judge for Fine-Grained Evaluation
    2024/01/12 by Seongyun Lee, Seungone Kim, Lee, Seongyun +7 · 25 citations
    Computer Science · #Computation and Language (cs.CL) #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Multimodal Machine Learning Applications #Natural Language Processing Techniques
  6. Consent in Crisis: The Rapid Decline of the AI Data Commons
    2024/07/20 by Shayne Longpre, Longpre, Shayne, Robert Mahari +104 · 5 voices · 13 citations
    Computer Science · Social Sciences · #Ethics and Social Impacts of AI #Privacy, Security, and Data Protection #Privacy-Preserving Technologies in Data #cs.AI #cs.CL #cs.LG
  7. The BiGGen Bench: A Principled Benchmark for Fine-grained Evaluation of Language Models with Language Models
    2024/06/09 by Seungone Kim, Kim, Seungone, Juyoung Suk +61 · 21 citations
    Computer Science · #Computation and Language (cs.CL) #FOS: Computer and information sciences #Natural Language Processing Techniques #Topic Modeling
  8. KMMLU: Measuring Massive Multitask Language Understanding in Korean
    2024/02/18 by Guijin Son, Hanwool Lee, Son, Guijin +15 · 1 voice · 13 citations
    Computer Science · #Computation and Language (cs.CL) #FOS: Computer and information sciences #Natural Language Processing Techniques #Topic Modeling #cs.CL
  9. Does Math Reasoning Improve General LLM Capabilities? Understanding Transferability of LLM Reasoning
    2025/07/01 by Maggie Huan, Y Li, Huan, Maggie +17 · 1 voice · 42 citations
    Computer Science · #cs.AI #cs.CL
  10. Aligning to Thousands of Preferences via System Message Generalization
    2024/05/28 by Seongyun Lee, Lee, Seongyun, Sue Hyun Park +5 · 15 citations
    Computer Science · Social Sciences · #Computation and Language (cs.CL) #FOS: Computer and information sciences #Multimedia Communication and Technology #Semantic Web and Ontologies #Speech and dialogue systems
  11. Pangea: A Fully Open Multilingual Multimodal LLM for 39 Languages
    2024/10/21 by Xiang Yue, Yue, Xiang, Yueqi Song +17 · 17 citations
    Arts and Humanities · Computer Science · #Computation and Language (cs.CL) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Natural Language Processing Techniques #Topic Modeling #Translation Studies and Practices
  12. Reasoning Models Better Express Their Confidence
    2025/05/20 by Dongkeun Yoon, Yoon, Dongkeun, Seungone Kim +15 · 17 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Semantic Web and Ontologies
  13. Evaluating Language Models as Synthetic Data Generators
    2024/12/04 by Seungone Kim, Juyoung Suk, Kim, Seungone +17 · 12 citations
    Computer Science · #Computation and Language (cs.CL) #FOS: Computer and information sciences #Natural Language Processing Techniques #Topic Modeling
  14. Self-Explore: Enhancing Mathematical Reasoning in Language Models with Fine-grained Rewards
    2024/04/16 by Hyeonbin Hwang, Hwang, Hyeonbin, Doyoung Kim +7 · 6 citations
    Computer Science · #Computation and Language (cs.CL) #FOS: Computer and information sciences #Natural Language Processing Techniques #Topic Modeling
  15. MM-Eval: A Multilingual Meta-Evaluation Benchmark for LLM-as-a-Judge and Reward Models
    2024/10/23 by Guijin Son, Son, Guijin, Dongkeun Yoon +16 · 6 citations
    Economics, Econometrics and Finance · Social Sciences · #Artificial Intelligence in Law #Computation and Language (cs.CL) #FOS: Computer and information sciences #Law, Economics, and Judicial Systems
  16. Scaling Evaluation-time Compute with Reasoning Models as Evaluators
    2025/03/25 by Seungone Kim, Kim, Seungone, Ian Wu +19 · 6 citations
    #cs.CL
  17. OptimalThinkingBench: Evaluating Over and Underthinking in LLMs
    2025/08/18 by Pranjal Aggarwal, Aggarwal, Pranjal, Seungone Kim +11 · 10 citations
    Computer Science · #Computation and Language (cs.CL) #FOS: Computer and information sciences #Library Science and Information Systems #Machine Learning (cs.LG) #Natural Language Processing Techniques #Semantic Web and Ontologies
  18. M-Prometheus: A Suite of Open Multilingual LLM Judges
    2025/04/07 by José P. Pombal, Pombal, José, Dongkeun Yoon +13 · 4 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Natural Language Processing Techniques #Text Readability and Simplification #Topic Modeling
  19. On the limits and opportunities of AI reviewers: Reviewing the reviews of Nature-family papers with 45 expert scientists
    2026/05/20 by Seungone Kim, Dongkeun Yoon, Kiril Gashteovski +55 · 4 voices
    #cs.CL #cs.AI #cs.LG