vix.ing · top · new · best · stats · spec

Han, Haonan

  1. REPARO: Compositional 3D Assets Generation with Differentiable 3D Layout Alignment
    2024/05/28 by Han, Haonan, Yang, Rui, Liao, Huan +6 · 14 citations
    #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
  2. MambaTalk: Efficient Holistic Gesture Synthesis with Selective State Space Models
    2024/03/14 by Zunnan Xu, Xu, Zunnan, Yukang Lin +11 · 8 citations
    Computer Science · Neuroscience · Psychology · #Hand Gesture Recognition Systems #Tactile and Sensory Interactions #Hearing Impairment and Communication
  3. Consistent123: One Image to Highly Consistent 3D Asset Using Case-Aware Diffusion Priors
    2023/09/29 by Yukang Lin, Lin, Yukang, Haonan Han +9 · 4 citations
    Computer Science · #Advanced Vision and Imaging #Computer Graphics and Visualization Techniques #Generative Adversarial Networks and Image Synthesis
  4. Densely Connected Parameter-Efficient Tuning for Referring Image Segmentation
    2025/01/15 by Jiaqi Huang, Zunnan Xu, Huang, Jiaqi +11 · 7 citations
    Computer Science · Neuroscience · #Advanced Image and Video Retrieval Techniques #Brain Tumor Detection and Classification #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Medical Image Segmentation Techniques
  5. BATON: Aligning Text-to-Audio Model with Human Preference Feedback
    2024/02/01 by Huan Liao, Liao, Huan, Haonan Han +17 · 3 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  6. AToM: Aligning Text-to-Motion Model at Event-Level with GPT-4Vision Reward
    2024/11/27 by Han, Haonan, Wu, Xiangzuo, Liao, Huan +5 · 3 citations
    #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
  7. Separate to Collaborate: Dual-Stream Diffusion Model for Coordinated Piano Hand Motion Synthesis
    2025/04/14 by Liu, Zihao, Ou, Mingwen, Xu, Zunnan +4 · 2 citations
    #Audio and Speech Processing (eess.AS) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering