vix.ing · top · new · best · stats · spec

Wang, Yabing

  1. Dual-view Curricular Optimal Transport for Cross-lingual Cross-modal Retrieval
    2023/09/11 by Wang, Yabing, Wang, Shuhui, Luo, Hao +5 · 3 citations
    #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Multimedia (cs.MM)
  2. Multimodal LLM Enhanced Cross-lingual Cross-modal Retrieval
    2024/09/30 by Yabing Wang, Wang, Yabing, Le Wang +11 · 4 citations
    Computer Science · #Computation and Language (cs.CL) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Natural Language Processing Techniques #Semantic Web and Ontologies #Topic Modeling
  3. CL2CM: Improving Cross-Lingual Cross-Modal Retrieval via Cross-Lingual Knowledge Transfer
    2023/12/14 by Yabing Wang, Wang, Yabing, Fan Wang +5 · 2 citations
    Computer Science · #Advanced Image and Video Retrieval Techniques #Computer Vision and Pattern Recognition (cs.CV) #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Multimedia (cs.MM) #Multimodal Machine Learning Applications
  4. Diversifying Query: Region-Guided Transformer for Temporal Sentence Grounding
    2024/05/31 by Xiaolong Sun, Liushuai Shi, Sun, Xiaolong +11 · 2 citations
    Computer Science · #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Natural Language Processing Techniques #Speech and dialogue systems #Topic Modeling
  5. Progressive Localization Networks for Language-based Moment Localization
    2021/02/02 by Zheng, Qi, Dong, Jianfeng, Qu, Xiaoye +5 · 1 citation
    #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
  6. Versatile Multimodal Controls for Expressive Talking Human Animation
    2025/03/10 by Zheng Qin, Qin, Zheng, Ruobing Zheng +13 · 4 citations
    Computer Science · Engineering · #Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Face recognition and analysis #Generative Adversarial Networks and Image Synthesis #Human Motion and Animation
  7. HumanSense: From Multimodal Perception to Empathetic Context-Aware Responses through Reasoning MLLMs
    2025/08/14 by Qin, Zheng, Zheng, Ruobing, Wang, Yabing +4 · 3 citations
    #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
  8. RSRNav: Reasoning Spatial Relationship for Image-Goal Navigation
    2025/04/25 by Qin, Zheng, Wang, Le, Wang, Yabing +3 · 1 citation
    #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Robotics (cs.RO)