Shaoteng Liu
- Mini-Gemini: Mining the Potential of Multi-modality Vision Language Models
2024/03/27 by Yanwei Li, Yuechen Zhang, Li, Yanwei +13 · 2 voices · 43 citations
Computer Science · #Multimodal Machine Learning Applications
- Video-P2P: Video Editing with Cross-attention Control
2023/03/08 by Shaoteng Liu, Yuechen Zhang, Liu, Shaoteng +7 · 54 citations
Computer Science · #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Generative Adversarial Networks and Image Synthesis #Multimodal Machine Learning Applications #Video Analysis and Summarization
- Direct Inversion: Boosting Diffusion-based Editing with 3 Lines of Code
2023/10/02 by Xuan Ju, Ailing Zeng, Ju, Xuan +7 · 23 citations
Biochemistry, Genetics and Molecular Biology · Computer Science · #Cell Image Analysis Techniques #Computer Vision and Pattern Recognition (cs.CV) #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Generative Adversarial Networks and Image Synthesis
- Tent: Fully Test-time Adaptation by Entropy Minimization
2020/06/18 by Dequan Wang, Wang, Dequan, Evan Shelhamer +7 · 8 citations
Computer Science · #Advanced Neural Network Applications #Computer Vision and Pattern Recognition (cs.CV) #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Multimodal Machine Learning Applications
- Generative Video Propagation
2024/12/27 by Shaoteng Liu, Tianyu Wang, Liu, Shaoteng +19 · 13 citations
Engineering · #Advanced MIMO Systems Optimization #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Telecommunications and Broadcasting Technologies
- Both Semantics and Reconstruction Matter: Making Representation Encoders Ready for Text-to-Image Generation and Editing
2025/12/19 by Shilong Zhang, Zhang, Shilong, He Zhang +25 · 1 citation
Computer Science · Engineering · #Generative Adversarial Networks and Image Synthesis #Face recognition and analysis #3D Shape Modeling and Analysis
- Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers
2026/07/30 by Chongjian Ge, Hanwen Jiang, Tianyu Wang +9
Computer Science · #cs.CV