vix.ing · top · new · best · stats · spec

Weifeng Chen

  1. Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning
    2023/05/23 by Weifeng Chen, Chen, Weifeng, Ji, Yatai +14 · 26 citations
    Computer Science · Engineering · #Artificial Intelligence (cs.AI) #Computer Graphics and Visualization Techniques #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Generative Adversarial Networks and Image Synthesis #Human Motion and Animation #Machine Learning (cs.LG) #Multimedia (cs.MM)
  2. OOTDiffusion: Outfitting Fusion based Latent Diffusion for Controllable Virtual Try-on
    2024/03/04 by Yuhao Xu, Tao Gu, Xu, Yuhao +5 · 29 citations
    Computer Science · #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Natural Language Processing Techniques #Speech Recognition and Synthesis #Topic Modeling
  3. ID-Aligner: Enhancing Identity-Preserving Text-to-Image Generation with Reward Feedback Learning
    2024/04/23 by Weifeng Chen, Jiacheng Zhang, Chen, Weifeng +9 · 1 voice · 6 citations
    Computer Science · #Artificial Intelligence in Games #Generative Adversarial Networks and Image Synthesis #Topic Modeling #cs.AI #cs.CV
  4. AffordanceLLM: Grounding Affordance from Vision Language Models
    2024/01/12 by Shengyi Qian, Weifeng Chen, Qian, Shengyi +9 · 14 citations
    Computer Science · Engineering · #Multimodal Machine Learning Applications #Domain Adaptation and Few-Shot Learning #Robot Manipulation and Learning
  5. OnlineVPO: Align Video Diffusion Model with Online Video-Centric Preference Optimization
    2024/12/19 by Jiacheng Zhang, Jie Ying Wu, Zhang, Jiacheng +11 · 17 citations
    Computer Science · #Advanced Image and Video Retrieval Techniques #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Image and Video Quality Assessment #Visual Attention and Saliency Detection
  6. OASIS: A Large-Scale Dataset for Single Image 3D in the Wild
    2020/07/26 by Weifeng Chen, Chen, Weifeng, Shengyi Qian +9 · 5 citations
    Computer Science · #Advanced Vision and Imaging #Optical measurement and interference techniques #Computer Graphics and Visualization Techniques
  7. DiffusionAgent: Navigating Expert Models for Agentic Image Generation
    2024/01/18 by Jie Qin, Jie Wu, Qin, Jie +11 · 1 voice · 4 citations
    Computer Science · #Generative Adversarial Networks and Image Synthesis #Multimodal Machine Learning Applications #Topic Modeling #cs.AI #cs.CV
  8. ViGoR: Improving Visual Grounding of Large Vision Language Models with Fine-Grained Reward Modeling
    2024/02/09 by Siming Yan, Yan, Siming, Min Bai +9 · 9 citations
    Computer Science · #Advanced Image and Video Retrieval Techniques #Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Image Retrieval and Classification Techniques #Multimodal Machine Learning Applications
  9. Learning to Sit: Synthesizing Human-Chair Interactions via Hierarchical Control
    2019/08/20 by Yu-Wei Chao, Jimei Yang, Chao, Yu-Wei +5 · 4 citations
    Computer Science · Engineering · #Advanced Vision and Imaging #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Human Motion and Animation #Human Pose and Action Recognition
  10. Magic Clothing: Controllable Garment-Driven Image Synthesis
    2024/04/15 by Weifeng Chen, Tao Gu, Chen, Weifeng +5 · 4 citations
    Computer Science · Engineering · #Generative Adversarial Networks and Image Synthesis #Computer Graphics and Visualization Techniques #3D Shape Modeling and Analysis
  11. IDA-VLM: Towards Movie Understanding via ID-Aware Large Vision-Language Model
    2024/07/10 by Yatai Ji, Ji, Yatai, Shilong Zhang +15 · 2 citations
    Computer Science · #Advanced Image and Video Retrieval Techniques #Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Image Retrieval and Classification Techniques #Video Analysis and Summarization