vix.ing · top · new · best · stats · spec

David D. Yao

  1. Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning
    2025/02/03 by Hanyang Zhao, Haoxian Chen, Zhao, Hanyang +7 · 11 citations
    Computer Science · Decision Sciences · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #FOS: Mathematics #Machine Learning (cs.LG) #Neural Networks and Applications #Optimization and Control (math.OC) #Reinforcement Learning in Robotics #Stock Market Forecasting Methods
  2. Policy Optimization for Continuous Reinforcement Learning
    2023/05/30 by Hanyang Zhao, Zhao, Hanyang, Wenpin Tang +3 · 4 citations
    Computer Science · #Advanced Multi-Objective Optimization Algorithms
  3. RainbowPO: A Unified Framework for Combining Improvements in Preference Optimization
    2024/10/05 by Hanyang Zhao, Zhao, Hanyang, Genta Indra Winata +11 · 6 citations
    Computer Science · #Advanced Database Systems and Queries #Artificial Intelligence (cs.AI) #Constraint Satisfaction and Optimization #Data Management and Algorithms #FOS: Computer and information sciences
  4. Scores as Actions: a framework of fine-tuning diffusion models by continuous-time reinforcement learning
    2024/09/12 by Hanyang Zhao, Haoxian Chen, Zhao, Hanyang +7 · 3 citations
    Computer Science · #Reinforcement Learning in Robotics
  5. A Continuous-Time Reinforcement Learning Framework for Fine-Tuning Discrete Diffusion Models
    2026/07/16 by Zikun Zhang, Jiayuan Sheng, David D. Yao +1
    #cs.LG