Xinyuan Chen
- VBench: Comprehensive Benchmark Suite for Video Generative Models
2023/11/29 by Ziqi Huang, Yinan He, Huang, Ziqi +29 · 359 citations
Computer Science · #Generative Adversarial Networks and Image Synthesis #Visual Attention and Saliency Detection #Human Pose and Action Recognition
- InternVid: A Large-scale Video-Text Dataset for Multimodal Understanding and Generation
2023/07/13 by Yi Wang, Yinan He, Wang, Yi +26 · 87 citations
Computer Science · #Multimodal Machine Learning Applications #Human Pose and Action Recognition #Video Analysis and Summarization
- Latte: Latent Diffusion Transformer for Video Generation
2024/01/05 by Xin Ma, Yaohui Wang, Ma, Xin +13 · 83 citations
Computer Science · #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Generative Adversarial Networks and Image Synthesis
- SinSR: Diffusion-Based Image Super-Resolution in a Single Step
2023/11/23 by Yufei Wang, Wang, Yufei, Wenhan Yang +17 · 44 citations
Computer Science · Engineering · Medicine · #Advanced Image Processing Techniques #Advanced Neuroimaging Techniques and Applications #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Sparse and Compressive Sensing Techniques
- LAVIE: High-Quality Video Generation with Cascaded Latent Diffusion Models
2023/09/26 by Yaohui Wang, Xinyuan Chen, Wang, Yaohui +37 · 43 citations
Computer Science · #Generative Adversarial Networks and Image Synthesis #Advanced Vision and Imaging
- SEINE: Short-to-Long Video Diffusion Model for Generative Transition and Prediction
2023/10/31 by Xinyuan Chen, Yaohui Wang, Chen, Xinyuan +17 · 37 citations
Computer Science · Economics, Econometrics and Finance · #Generative Adversarial Networks and Image Synthesis #Cinema and Media Studies
- Vlogger: Make Your Dream A Vlog
2024/01/17 by Shaobin Zhuang, Zhuang, Shaobin, Kunchang Li +11 · 1 voice · 16 citations
Computer Science · #Human Pose and Action Recognition #Multimodal Machine Learning Applications #Video Analysis and Summarization #cs.AI #cs.CV #cs.LG #cs.MM
- 4Diffusion: Multi-view Video Diffusion Model for 4D Generation
2024/05/31 by Haiyu Zhang, Zhang, Haiyu, Xinyuan Chen +9 · 34 citations
Social Sciences · #Multimedia Communication and Technology
- Vchitect-2.0: Parallel Transformer for Scaling Up Video Diffusion Models
2025/01/14 by Fan, Weichen, Chenyang Si, Si, Chenyang +31 · 20 citations
Computer Science · #Advanced Vision and Imaging #Computer Graphics and Visualization Techniques #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Image and Signal Denoising Methods #Machine Learning (cs.LG)
- DG-Font: Deformable Generative Networks for Unsupervised Font Generation
2021/04/07 by Yangchen Xie, Xie, Yangchen, Xinyuan Chen +5 · 4 citations
Computer Science · #Generative Adversarial Networks and Image Synthesis #Video Analysis and Summarization #Computer Graphics and Visualization Techniques
- Diff-Font: Diffusion Model for Robust One-Shot Font Generation
2022/12/12 by Haibin He, He, Haibin, Xinyuan Chen +11 · 5 citations
Computer Science · Engineering · #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Handwritten Text Recognition Techniques #Human Motion and Animation #Video Analysis and Summarization
- Cross Attention Based Style Distribution for Controllable Person Image Synthesis
2022/08/01 by Xinyue Zhou, Zhou, Xinyue, Mingyu Yin +9 · 3 citations
Computer Science · #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Face recognition and analysis #Generative Adversarial Networks and Image Synthesis #Human Pose and Action Recognition
- Hierarchical Diffusion Autoencoders and Disentangled Image Manipulation
2023/04/24 by Zeyu Lu, Chengyue Wu, Lu, Zeyu +11 · 3 citations
Computer Science · #Generative Adversarial Networks and Image Synthesis #Advanced Image Processing Techniques #Digital Media Forensic Detection
- AccVideo: Accelerating Video Diffusion Model with Synthetic Dataset
2025/03/25 by Haiyu Zhang, Xinyuan Chen, Zhang, Haiyu +9 · 1 voice · 3 citations
Computer Science · #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #cs.CV
- VBench++: Comprehensive and Versatile Benchmark Suite for Video Generative Models
2024/11/20 by Ziqi Huang, Huang, Ziqi, Fan Zhang +31 · 4 citations
Computer Science · Engineering · #Advanced Vision and Imaging #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Generative Adversarial Networks and Image Synthesis #Human Motion and Animation
- CineTrans: Learning to Generate Videos with Cinematic Transitions via Masked Diffusion Models
2025/08/15 by Xiaoxue Wu, Wu, Xiaoxue, Bin Gao +7 · 7 citations
Computer Science · #Video Analysis and Summarization #Generative Adversarial Networks and Image Synthesis #Human Pose and Action Recognition
- Vinci: A Real-time Embodied Smart Assistant based on Egocentric Vision-Language Model
2024/12/30 by Yifei Huang, Jilan Xu, Huang, Yifei +33 · 4 citations
Engineering · #Robotics and Automated Systems
- The Devil is in the Prompts: Retrieval-Augmented Prompt Optimization for Text-to-Video Generation
2025/04/16 by Bin Gao, Xinyu Gao, Gao, Bingjie +13 · 5 citations
Computer Science · Engineering · Social Sciences · #Computation and Language (cs.CL) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Human Motion and Animation #Multimedia Communication and Technology #Video Analysis and Summarization
- An Egocentric Vision-Language Model based Portable Real-time Smart Assistant
2025/03/06 by Yifei Huang, Huang, Yifei, Jilan Xu +35 · 2 citations
Computer Science · Psychology · #Multimodal Machine Learning Applications #Social Robot Interaction and HRI #Advanced Neural Network Applications
- DeforM: Reasoning-Guided Physics-Aware Video Generation via Spatial-Temporal Masking
2026/07/21 by Yunyi Li, Yu Qiao, Yaohui Wang +1
#cs.CV