vix.ing · top · new · best · stats · spec

Shengyu Ye

  1. Reinforcement Learning with Verifiable Rewards Implicitly Incentivizes Correct Reasoning in Base LLMs
    2025/06/17 by Xumeng Wen, Zihan Liu, Wen, Xumeng +20 · 56 citations
    Computer Science · #Reinforcement Learning in Robotics
  2. VPTQ: Extreme Low-bit Vector Post-Training Quantization for Large Language Models
    2024/09/25 by Yifei Liu, Liu, Yifei, Jicheng Wen +13 · 7 citations
    Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Natural Language Processing Techniques #Speech Recognition and Synthesis #Topic Modeling