Gu, Shuyang
- Vector Quantized Diffusion Model for Text-to-Image Synthesis
2021/11/29 by Shuyang Gu, Gu, Shuyang, Dong Chen +13 · 58 citations
Computer Science · #Advanced Image and Video Retrieval Techniques #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Generative Adversarial Networks and Image Synthesis #Machine Learning (cs.LG) #Video Analysis and Summarization
- Paint by Example: Exemplar-based Image Editing with Diffusion Models
2022/11/23 by Binxin Yang, Yang, Binxin, Shuyang Gu +13 · 41 citations
Computer Science · Engineering · #Generative Adversarial Networks and Image Synthesis #Domain Adaptation and Few-Shot Learning #Image Processing Techniques and Applications
- Rodin: A Generative Model for Sculpting 3D Digital Avatars Using Diffusion
2022/12/12 by Tengfei Wang, Wang, Tengfei, Bo Zhang +19 · 30 citations
Computer Science · Engineering · #Generative Adversarial Networks and Image Synthesis #Human Motion and Animation #3D Shape Modeling and Analysis
- InstructDiffusion: A Generalist Modeling Interface for Vision Tasks
2023/09/07 by Geng, Zigang, Yang, Binxin, Hang, Tiankai +8 · 21 citations
#Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
- Efficient Diffusion Training via Min-SNR Weighting Strategy
2023/03/16 by Tiankai Hang, Shuyang Gu, Hang, Tiankai +13 · 18 citations
Computer Science · Medicine · #Advanced Neuroimaging Techniques and Applications #Computer Vision and Pattern Recognition (cs.CV) #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Generative Adversarial Networks and Image Synthesis
- Aesthetic Post-Training Diffusion Models from Generic Preferences with Step-by-step Preference Optimization
2024/06/06 by Zhanhao Liang, Yuhui Yuan, Liang, Zhanhao +12 · 19 citations
Engineering · Environmental Science · #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Urban Design and Spatial Analysis #Urban Planning and Valuation
- StyleSwin: Transformer-based GAN for High-resolution Image Generation
2021/12/20 by Bowen Zhang, Zhang, Bowen, Shuyang Gu +13 · 10 citations
Computer Science · #Advanced Neural Network Applications #Advanced Vision and Imaging #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Generative Adversarial Networks and Image Synthesis
- Arbitrary Style Transfer with Deep Feature Reshuffle
2018/05/10 by Shuyang Gu, Gu, Shuyang, Congliang Chen +5 · 5 citations
Computer Science · #Advanced Image Processing Techniques #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Generative Adversarial Networks and Image Synthesis #Image Enhancement Techniques
- CLIP Itself is a Strong Fine-tuner: Achieving 85.7% and 88.0% Top-1 Accuracy with ViT-B and ViT-L on ImageNet
2022/12/12 by Dong, Xiaoyi, Bao, Jianmin, Zhang, Ting +7 · 6 citations
#Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Machine Learning (cs.LG)
- X-Omni: Reinforcement Learning Makes Discrete Autoregressive Image Generative Models Great Again
2025/07/29 by Geng, Zigang, Wang, Yibing, Ma, Yeyao +10 · 28 citations
#Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
- Improved Vector Quantized Diffusion Models
2022/05/31 by Zhicong Tang, Tang, Zhicong, Shuyang Gu +7 · 5 citations
Computer Science · #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Generative Adversarial Networks and Image Synthesis #Image Retrieval and Classification Techniques #Music and Audio Processing
- DesignDiffusion: High-Quality Text-to-Design Image Generation with Diffusion Models
2025/03/03 by Zhendong Wang, Jianmin Bao, Wang, Zhendong +9 · 10 citations
Computer Science · Arts and Humanities · #Handwritten Text Recognition Techniques #Digital Humanities and Scholarship #Image Retrieval and Classification Techniques
- VolumeDiffusion: Flexible Text-to-3D Generation with Efficient Volumetric Encoder
2023/12/18 by Tang, Zhicong, Gu, Shuyang, Wang, Chunyu +4 · 5 citations
#Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
- GIQA: Generated Image Quality Assessment
2020/03/19 by Gu, Shuyang, Bao, Jianmin, Chen, Dong +1 · 2 citations
#Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #FOS: Electrical engineering #Image and Video Processing (eess.IV) #electronic engineering #information engineering
- Improved Noise Schedule for Diffusion Training
2024/07/03 by Hang, Tiankai, Gu, Shuyang, Geng, Xin +1 · 4 citations
#Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
- FontStudio: Shape-Adaptive Diffusion Model for Coherent and Consistent Font Effect Generation
2024/06/12 by Xinzhi Mu, Mu, Xinzhi, Li Chen +13 · 3 citations
Computer Science · Engineering · #Computer Graphics and Visualization Techniques #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Simulation and Modeling Applications
- PromptEnhancer: A Simple Approach to Enhance Text-to-Image Models via Chain-of-Thought Prompt Rewriting
2025/09/04 by Linqing Wang, Ximing Xing, Wang, Linqing +29 · 10 citations
Computer Science · #Data Visualization and Analytics
- Mask-Guided Portrait Editing with Conditional GANs
2019/05/24 by Gu, Shuyang, Bao, Jianmin, Yang, Hao +3 · 1 citation
#Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
- High-Fidelity and Arbitrary Face Editing
2021/03/29 by Yue Gao, Gao, Yue, Fangyun Wei +11 · 1 citation
Computer Science · Medicine · #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Face recognition and analysis #Facial Nerve Paralysis Treatment and Research
- Optimal Stepsize for Diffusion Sampling
2025/03/27 by J. C. Pei, Pei, Jianning, Han Hu +3 · 1 citation
Computer Science · #Bayesian Methods and Mixture Models #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Speech and Audio Processing