Lvmin Zhang
- Adding Conditional Control to Text-to-Image Diffusion Models
2023/02/10 by Lvmin Zhang, Zhang, Lvmin, Rao, Anyi +1 · 716 citations
Medicine · #Advanced Neuroimaging Techniques and Applications
- Transparent Image Layer Diffusion using Latent Transparency
2024/02/27 by Lvmin Zhang, Maneesh Agrawala, Zhang, Lvmin +1 · 3 voices · 22 citations
Computer Science · #Advanced Image Processing Techniques #Image and Signal Denoising Methods #Advanced Data Compression Techniques
- Adding Conditional Control to Text-to-Image Diffusion Models
2023/10/01 by Lvmin Zhang, Anyi Rao, Maneesh Agrawala · 417 citations
Medicine · Computer Science · Physics and Astronomy · #Advanced Neuroimaging Techniques and Applications #Generative Adversarial Networks and Image Synthesis #Model Reduction and Neural Networks
- Frame Context Packing and Drift Prevention in Next-Frame-Prediction Video Diffusion Models
2025/04/17 by Lvmin Zhang, Zhang, Lvmin, Shengqu Cai +7 · 34 citations
Computer Science · #Advanced Data Compression Techniques #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Image and Video Quality Assessment #Video Coding and Compression Technologies
- Captain Cinema: Towards Short Movie Generation
2025/07/24 by Junfei Xiao, Ceyuan Yang, Xiao, Junfei +16 · 19 citations
Economics, Econometrics and Finance · #Cinema and Media Studies #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
- Style Transfer for Anime Sketches with Enhanced Residual U-net and Auxiliary Classifier GAN
2017/06/11 by Lvmin Zhang, Yi Ji, Zhang, Lvmin +3 · 3 citations
Computer Science · #Computer Graphics and Visualization Techniques #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Generative Adversarial Networks and Image Synthesis #Video Analysis and Summarization
- Mixture of Contexts for Long Video Generation
2025/08/28 by Shengqu Cai, Cai, Shengqu, Ceyuan Yang +22 · 24 citations
Computer Science · #Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Generative Adversarial Networks and Image Synthesis #Graphics (cs.GR) #Video Analysis and Summarization
- Masked Visual Actions for Unified World Modeling
2026/07/21 by Hadi Alzayer, Wenlong Huang, Haonan Chen +8
#cs.CV #cs.RO