Cipolina-Kun, Lucia
- Alice in Wonderland: Simple Tasks Showing Complete Reasoning Breakdown in State-Of-the-Art Large Language Models
2024/06/04 by Marianna Nezhurina, Nezhurina, Marianna, Lucia Cipolina-Kun +5 · 24 voices · 11 citations
Computer Science · #Natural Language Processing Techniques #Topic Modeling #cs.AI #cs.CL #cs.LG
- Game Reasoning Arena: A Framework and Benchmark for Assessing Reasoning Capabilities of Large Language Models via Game Play
2025/08/05 by Lucia Cipolina-Kun, Marianna Nezhurina, Cipolina-Kun, Lucia +3 · 2 voices · 5 citations
#cs.AI #cs.GT
- The Automated LLM Speedrunning Benchmark: Reproducing NanoGPT Improvements
2025/06/27 by Zhao, Bingchen, Magka, Despoina, Jiang, Minqi +20 · 1 citation
#Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Machine Learning (cs.LG)