vix.ing · top · new · best · stats · spec

Cipolina-Kun, Lucia

  1. Alice in Wonderland: Simple Tasks Showing Complete Reasoning Breakdown in State-Of-the-Art Large Language Models
    2024/06/04 by Marianna Nezhurina, Nezhurina, Marianna, Lucia Cipolina-Kun +5 · 24 voices · 11 citations
    Computer Science · #Natural Language Processing Techniques #Topic Modeling #cs.AI #cs.CL #cs.LG
  2. Game Reasoning Arena: A Framework and Benchmark for Assessing Reasoning Capabilities of Large Language Models via Game Play
    2025/08/05 by Lucia Cipolina-Kun, Marianna Nezhurina, Cipolina-Kun, Lucia +3 · 2 voices · 5 citations
    #cs.AI #cs.GT
  3. The Automated LLM Speedrunning Benchmark: Reproducing NanoGPT Improvements
    2025/06/27 by Zhao, Bingchen, Magka, Despoina, Jiang, Minqi +20 · 1 citation
    #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Machine Learning (cs.LG)