vix.ing · top · new · best · stats · spec

Hui, Tianrui

  1. Cross-Modal Progressive Comprehension for Referring Segmentation
    2021/05/15 by Liu, Si, Hui, Tianrui, Huang, Shaofei +3 · 13 citations
    #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Multimedia (cs.MM)
  2. Referring Image Segmentation via Cross-Modal Progressive Comprehension
    2020/10/01 by Huang, Shaofei, Hui, Tianrui, Liu, Si +5 · 10 citations
    #Computation and Language (cs.CL) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
  3. LLaVA-ST: A Multimodal Large Language Model for Fine-Grained Spatial-Temporal Understanding
    2025/01/14 by Li, Hongyu, Chen, Jinyu, Wei, Ziyu +5 · 26 citations
    #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
  4. Linguistic Structure Guided Context Modeling for Referring Image Segmentation
    2020/10/01 by Tianrui Hui, Hui, Tianrui, Si Liu +11 · 6 citations
    Computer Science · #Multimodal Machine Learning Applications #Domain Adaptation and Few-Shot Learning #Topic Modeling
  5. Language-Bridged Spatial-Temporal Interaction for Referring Video Object Segmentation
    2022/06/08 by Zihan Ding, Ding, Zihan, Tianrui Hui +9 · 5 citations
    Computer Science · #Advanced Neural Network Applications #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Human Pose and Action Recognition #Multimedia (cs.MM) #Multimodal Machine Learning Applications
  6. A Keypoint-based Global Association Network for Lane Detection
    2022/04/15 by Jinsheng Wang, Yinchao Ma, Wang, Jinsheng +11 · 5 citations
    Engineering · Computer Science · #Autonomous Vehicle Technology and Safety #Anomaly Detection Techniques and Applications
  7. Customize your NeRF: Adaptive Source Driven 3D Scene Editing via Local-Global Iterative Training
    2023/12/04 by He, Runze, Huang, Shaofei, Nie, Xuecheng +6 · 6 citations
    #Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
  8. Unleashing the Temporal-Spatial Reasoning Capacity of GPT for Training-Free Audio and Language Referenced Video Object Segmentation
    2024/08/28 by Shaofei Huang, Huang, Shaofei, Rui Ling +13 · 7 citations
    Computer Science · #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Multimodal Machine Learning Applications
  9. Collaborative Spatial-Temporal Modeling for Language-Queried Video Actor Segmentation
    2021/05/14 by Tianrui Hui, Hui, Tianrui, Shaofei Huang +13 · 3 citations
    Computer Science · #Multimodal Machine Learning Applications #Human Pose and Action Recognition #Advanced Neural Network Applications
  10. PPMN: Pixel-Phrase Matching Network for One-Stage Panoptic Narrative Grounding
    2022/08/11 by Ding, Zihan, Ding, Zi-han, Hui, Tianrui +4 · 1 citation
    #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Multimedia (cs.MM)
  11. Cross-Modality Domain Adaptation for Freespace Detection: A Simple yet Effective Baseline
    2022/10/06 by Wang, Yuanbin, Zhu, Leyan, Huang, Shaofei +4 · 1 citation
    #Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
  12. Enriching Phrases with Coupled Pixel and Object Contexts for Panoptic Narrative Grounding
    2023/11/02 by Tianrui Hui, Zihan Ding, Hui, Tianrui +13 · 1 citation
    Computer Science · #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Multimodal Machine Learning Applications #Natural Language Processing Techniques #Video Analysis and Summarization
  13. Dynamic Prompting of Frozen Text-to-Image Diffusion Models for Panoptic Narrative Grounding
    2024/09/12 by Hongyu Li, Tianrui Hui, Li, Hongyu +13 · 1 citation
    Arts and Humanities · Computer Science · #Artificial Intelligence in Games #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Narrative Theory and Analysis #Topic Modeling
  14. Revisiting Audio-Visual Segmentation with Vision-Centric Transformer
    2025/06/30 by Shaofei Huang, Huang, Shaofei, Rui Ling +15 · 2 citations
    Computer Science · #Music and Audio Processing #Speech and Audio Processing #Video Analysis and Summarization