vix.ing · top · new · best · stats · spec

Hanshu Yan

  1. Aria: An Open Multimodal Native Mixture-of-Experts Model
    2024/10/08 by Dongxu Li, Li, Dongxu, Yudong Liu +37 · 2 voices · 32 citations
    Computer Science · Social Sciences · #Expert finding and Q&A systems #Human Mobility and Location-Based Analysis #Mobile Crowdsensing and Crowdsourcing #cs.CV
  2. MagicAnimate: Temporally Consistent Human Image Animation using Diffusion Model
    2023/11/27 by Zhongcong Xu, Jianfeng Zhang, Xu, Zhongcong +14 · 1 voice · 50 citations
    Computer Science · #Advanced Vision and Imaging #Generative Adversarial Networks and Image Synthesis #Human Pose and Action Recognition #cs.CV #cs.GR
  3. MagicVideo: Efficient Video Generation With Latent Diffusion Models
    2022/11/20 by Daquan Zhou, Zhou, Daquan, Weimin Wang +9 · 32 citations
    Computer Science · #Generative Adversarial Networks and Image Synthesis #Video Analysis and Summarization
  4. Efficient Sharpness-aware Minimization for Improved Training of Neural Networks
    2021/10/07 by Jiawei Du, Du, Jiawei, Hanshu Yan +11 · 17 citations
    Computer Science · #Advanced Neural Network Applications #Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning and Data Classification
  5. PeRFlow: Piecewise Rectified Flow as Universal Plug-and-Play Accelerator
    2024/05/13 by Hanshu Yan, Yan, Hanshu, Xingchao Liu +9 · 21 citations
    Computer Science · #Advanced Data Storage Technologies #Parallel Computing and Optimization Techniques
  6. MagicEdit: High-Fidelity and Temporally Coherent Video Editing
    2023/08/28 by Jun Hao Liew, Liew, Jun Hao, Hanshu Yan +7 · 9 citations
    Computer Science · #Computer Vision and Pattern Recognition (cs.CV) #Digital Media Forensic Detection #FOS: Computer and information sciences #Generative Adversarial Networks and Image Synthesis #Video Analysis and Summarization
  7. MagicMix: Semantic Mixing with Diffusion Models
    2022/10/28 by Jun Hao Liew, Hanshu Yan, Liew, Jun Hao +5 · 7 citations
    Computer Science · #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Generative Adversarial Networks and Image Synthesis #Music and Audio Processing #Video Analysis and Summarization
  8. DiG: Scalable and Efficient Diffusion Models with Gated Linear Attention
    2024/05/28 by Lianghui Zhu, Zilong Huang, Zhu, Lianghui +11 · 11 citations
    Physics and Astronomy · #Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Model Reduction and Neural Networks
  9. ClassDiffusion: More Aligned Personalization Tuning with Explicit Class Guidance
    2024/05/27 by Jiannan Huang, Jun Hao Liew, Huang, Jiannan +9 · 6 citations
    Social Sciences · #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Multimedia Communication and Technology
  10. LightningDrag: Lightning Fast and Accurate Drag-based Image Editing Emerging from Videos
    2024/05/22 by Yujun Shi, Jun Hao Liew, Shi, Yujun +7 · 5 citations
    Computer Science · #Computer Graphics and Visualization Techniques #Generative Adversarial Networks and Image Synthesis #Image Enhancement Techniques
  11. OFTSR: One-Step Flow for Image Super-Resolution with Tunable Fidelity-Realism Trade-offs
    2024/12/12 by Yuanzhi Zhu, Ruiqing Wang, Zhu, Yuanzhi +9 · 6 citations
    Computer Science · #Advanced Image Processing Techniques #Advanced Vision and Imaging #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Image and Signal Denoising Methods
  12. MagicProp: Diffusion-based Video Editing via Motion-aware Appearance Propagation
    2023/09/02 by Hanshu Yan, Jun Hao Liew, Yan, Hanshu +7 · 2 citations
    Computer Science · Engineering · #3D Shape Modeling and Analysis #Advanced Vision and Imaging #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Generative Adversarial Networks and Image Synthesis
  13. MagicAvatar: Multimodal Avatar Generation and Animation
    2023/08/28 by Jianfeng Zhang, Zhang, Jianfeng, Hanshu Yan +7 · 2 citations
    Engineering · Computer Science · #Human Motion and Animation #Human Pose and Action Recognition #Multimodal Machine Learning Applications
  14. Towards Adversarially Robust Deep Image Denoising
    2022/01/12 by Hanshu Yan, Jingfeng Zhang, Yan, Hanshu +7 · 1 citation
    Computer Science · #Image and Signal Denoising Methods #Advanced Image Processing Techniques #Adversarial Robustness in Machine Learning
  15. Accelerating Video Diffusion Models via Distribution Matching
    2024/12/08 by Yuanzhi Zhu, Zhu, Yuanzhi, Hanshu Yan +7 · 1 citation
    Computer Science · Biochemistry, Genetics and Molecular Biology · #Video Coding and Compression Technologies #Video Analysis and Summarization #Cancer-related molecular mechanisms research
  16. StateAct: Program State, before Pixels, for Long-Horizon Computer-Use Agents
    2026/07/24 by Yan Yang, Xiangru Jian, Ziyang Luo +7
    #cs.SE #cs.CV