vix.ing · top · new · best · stats · spec

He, Yingqing

  1. VideoCrafter1: Open Diffusion Models for High-Quality Video Generation
    2023/10/30 by Haoxin Chen, Chen, Haoxin, Menghan Xia +21 · 1 voice · 90 citations
    Computer Science · #Generative Adversarial Networks and Image Synthesis #Video Analysis and Summarization #cs.CV
  2. Latent Video Diffusion Models for High-Fidelity Long Video Generation
    2022/11/23 by Yingqing He, Tianyu Yang, He, Yingqing +7 · 65 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Generative Adversarial Networks and Image Synthesis
  3. Follow Your Pose: Pose-Guided Text-to-Video Generation using Pose-Free Videos
    2023/04/03 by Yue Ma, Yingqing He, Ma, Yue +12 · 52 citations
    Engineering · Computer Science · #Human Motion and Animation #Multimodal Machine Learning Applications #Human Pose and Action Recognition
  4. FreeNoise: Tuning-Free Longer Video Diffusion via Noise Rescheduling
    2023/10/23 by Haonan Qiu, Menghan Xia, Qiu, Haonan +11 · 1 voice · 24 citations
    Computer Science · #Generative Adversarial Networks and Image Synthesis #cs.CV
  5. Follow-Your-Emoji: Fine-Controllable and Expressive Freestyle Portrait Animation
    2024/06/04 by Ma, Yue, Liu, Hongyu, Wang, Hongfa +8 · 46 citations
    #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
  6. Seeing and Hearing: Open-domain Visual-Audio Generation with Diffusion Latent Aligners
    2024/02/27 by Yazhou Xing, Xing, Yazhou, Yingqing He +7 · 30 citations
    Computer Science · #Music and Audio Processing
  7. ScaleCrafter: Tuning-free Higher-Resolution Visual Generation with Diffusion Models
    2023/10/11 by Yingqing He, Shaoshu Yang, He, Yingqing +17 · 25 citations
    Computer Science · Engineering · #Generative Adversarial Networks and Image Synthesis #Advanced Image Processing Techniques #Image Processing Techniques and Applications
  8. Make-Your-Video: Customized Video Generation Using Textual and Structural Guidance
    2023/06/01 by Jinbo Xing, Menghan Xia, Xing, Jinbo +21 · 17 citations
    Computer Science · Engineering · #Generative Adversarial Networks and Image Synthesis #Video Analysis and Summarization #Human Motion and Animation
  9. VideoDPO: Omni-Preference Alignment for Video Diffusion Generation
    2024/12/18 by Runtao Liu, Liu, Runtao, Haoyu Wu +11 · 31 citations
    Computer Science · Social Sciences · #Video Coding and Compression Technologies #Multimedia Communication and Technology #Advanced Vision and Imaging
  10. Make a Cheap Scaling: A Self-Cascade Diffusion Model for Higher-Resolution Adaptation
    2024/02/16 by Lanqing Guo, Yingqing He, Guo, Lanqing +21 · 16 citations
    Environmental Science · #Wind and Air Flow Studies
  11. MagicStick: Controllable Video Editing via Control Handle Transformations
    2023/12/05 by Ma, Yue, Cun, Xiaodong, Liang, Sen +5 · 14 citations
    #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
  12. Animate-A-Story: Storytelling with Retrieval-Augmented Video Generation
    2023/07/13 by He, Yingqing, Xia, Menghan, Chen, Haoxin +8 · 9 citations
    #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
  13. FreeTraj: Tuning-Free Trajectory Control in Video Diffusion Models
    2024/06/24 by Haonan Qiu, Zhaoxi Chen, Qiu, Haonan +9 · 11 citations
    Computer Science · #Video Coding and Compression Technologies
  14. Controllable Video Generation: A Survey
    2025/07/22 by Yue Ma, Kun Feng, Ma, Yue +36 · 33 citations
    Computer Science · #Advanced Vision and Imaging #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Graphics (cs.GR) #Video Analysis and Summarization #Video Coding and Compression Technologies
  15. TaleCrafter: Interactive Story Visualization with Multiple Characters
    2023/05/29 by Yuan Gong, Youxin Pang, Gong, Yuan +19 · 6 citations
    Engineering · Computer Science · #Human Motion and Animation #Video Analysis and Summarization #Multimodal Machine Learning Applications
  16. LLMs Meet Multimodal Generation and Editing: A Survey
    2024/05/29 by He, Yingqing, Liu, Zhaoyang, Chen, Jingye +13 · 4 citations
    #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Multimedia (cs.MM) #Sound (cs.SD)
  17. HiPrompt: Tuning-free Higher-Resolution Generation with Hierarchical MLLM Prompts
    2024/09/04 by Xinyu Liu, Liu, Xinyu, Yingqing He +22 · 4 citations
    Computer Science · #Video Analysis and Summarization #Advanced Vision and Imaging
  18. Large Motion Video Autoencoding with Cross-modal Video VAE
    2024/12/23 by Yazhou Xing, Xing, Yazhou, Fei Yang +11 · 4 citations
    Computer Science · #Advanced Image Processing Techniques #Image and Video Quality Assessment #Image and Signal Denoising Methods
  19. Follow-Your-Click: Open-domain Regional Image Animation via Short Prompts
    2024/03/13 by Ma, Yue, He, Yingqing, Wang, Hongfa +8 · 3 citations
    #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
  20. Follow-Your-Emoji-Faster: Towards Efficient, Fine-Controllable, and Expressive Freestyle Portrait Animation
    2025/09/20 by Yue Ma, Zexuan Yan, Ma, Yue +25 · 14 citations
    Computer Science · Engineering · #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Human Motion and Animation #Video Analysis and Summarization
  21. MMTrail: A Multimodal Trailer Video Dataset with Language and Music Descriptions
    2024/07/30 by Xiaowei Chi, Chi, Xiaowei, Yatian Wang +35 · 1 citation
    Arts and Humanities · Computer Science · #Audio and Speech Processing (eess.AS) #Computer Vision and Pattern Recognition (cs.CV) #Diverse Musicological Studies #FOS: Computer and information sciences #FOS: Electrical engineering #Multimedia (cs.MM) #Music and Audio Processing #Sound (cs.SD) #electronic engineering #information engineering
  22. ModelGrow: Continual Text-to-Video Pre-training with Model Expansion and Language Understanding Enhancement
    2024/12/25 by Zhefan Rao, Lili Ji, Rao, Zhefan +15 · 1 citation
    Computer Science · #Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multimodal Machine Learning Applications #Natural Language Processing Techniques #Topic Modeling