Hui, Tianrui
- Cross-Modal Progressive Comprehension for Referring Segmentation
2021/05/15 by Liu, Si, Hui, Tianrui, Huang, Shaofei +3 · 13 citations
#Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Multimedia (cs.MM)
- Referring Image Segmentation via Cross-Modal Progressive Comprehension
2020/10/01 by Huang, Shaofei, Hui, Tianrui, Liu, Si +5 · 10 citations
#Computation and Language (cs.CL) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
- LLaVA-ST: A Multimodal Large Language Model for Fine-Grained Spatial-Temporal Understanding
2025/01/14 by Li, Hongyu, Chen, Jinyu, Wei, Ziyu +5 · 26 citations
#Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
- Linguistic Structure Guided Context Modeling for Referring Image Segmentation
2020/10/01 by Tianrui Hui, Hui, Tianrui, Si Liu +11 · 6 citations
Computer Science · #Multimodal Machine Learning Applications #Domain Adaptation and Few-Shot Learning #Topic Modeling
- Language-Bridged Spatial-Temporal Interaction for Referring Video Object Segmentation
2022/06/08 by Zihan Ding, Ding, Zihan, Tianrui Hui +9 · 5 citations
Computer Science · #Advanced Neural Network Applications #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Human Pose and Action Recognition #Multimedia (cs.MM) #Multimodal Machine Learning Applications
- A Keypoint-based Global Association Network for Lane Detection
2022/04/15 by Jinsheng Wang, Yinchao Ma, Wang, Jinsheng +11 · 5 citations
Engineering · Computer Science · #Autonomous Vehicle Technology and Safety #Anomaly Detection Techniques and Applications
- Customize your NeRF: Adaptive Source Driven 3D Scene Editing via Local-Global Iterative Training
2023/12/04 by He, Runze, Huang, Shaofei, Nie, Xuecheng +6 · 6 citations
#Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
- Unleashing the Temporal-Spatial Reasoning Capacity of GPT for Training-Free Audio and Language Referenced Video Object Segmentation
2024/08/28 by Shaofei Huang, Huang, Shaofei, Rui Ling +13 · 7 citations
Computer Science · #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Multimodal Machine Learning Applications
- Collaborative Spatial-Temporal Modeling for Language-Queried Video Actor Segmentation
2021/05/14 by Tianrui Hui, Hui, Tianrui, Shaofei Huang +13 · 3 citations
Computer Science · #Multimodal Machine Learning Applications #Human Pose and Action Recognition #Advanced Neural Network Applications
- PPMN: Pixel-Phrase Matching Network for One-Stage Panoptic Narrative Grounding
2022/08/11 by Ding, Zihan, Ding, Zi-han, Hui, Tianrui +4 · 1 citation
#Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Multimedia (cs.MM)
- Cross-Modality Domain Adaptation for Freespace Detection: A Simple yet Effective Baseline
2022/10/06 by Wang, Yuanbin, Zhu, Leyan, Huang, Shaofei +4 · 1 citation
#Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
- Enriching Phrases with Coupled Pixel and Object Contexts for Panoptic Narrative Grounding
2023/11/02 by Tianrui Hui, Zihan Ding, Hui, Tianrui +13 · 1 citation
Computer Science · #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Multimodal Machine Learning Applications #Natural Language Processing Techniques #Video Analysis and Summarization
- Dynamic Prompting of Frozen Text-to-Image Diffusion Models for Panoptic Narrative Grounding
2024/09/12 by Hongyu Li, Tianrui Hui, Li, Hongyu +13 · 1 citation
Arts and Humanities · Computer Science · #Artificial Intelligence in Games #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Narrative Theory and Analysis #Topic Modeling
- Revisiting Audio-Visual Segmentation with Vision-Centric Transformer
2025/06/30 by Shaofei Huang, Huang, Shaofei, Rui Ling +15 · 2 citations
Computer Science · #Music and Audio Processing #Speech and Audio Processing #Video Analysis and Summarization