vix.ing · top · new · best · stats · spec

Paul Hongsuck Seo

  1. Vid2Seq: Large-Scale Pretraining of a Visual Language Model for Dense Video Captioning
    2023/02/27 by Antoine Yang, Yang, Antoine, Arsha Nagrani +13 · 40 citations
    Computer Science · #Multimodal Machine Learning Applications #Human Pose and Action Recognition #Video Analysis and Summarization
  2. CAT-Seg: Cost Aggregation for Open-Vocabulary Semantic Segmentation
    2023/03/21 by Seokju Cho, Cho, Seokju, Heeseong Shin +9 · 37 citations
    Computer Science · #Multimodal Machine Learning Applications #Natural Language Processing Techniques #Topic Modeling
  3. Image Diffusion Models Exhibit Emergent Temporal Propagation in Videos
    2025/11/25 by Youngseo Kim, Kim, Youngseo, Dohyun Kim +5 · 15 voices
    Computer Science · #Domain Adaptation and Few-Shot Learning #Visual Attention and Saliency Detection #Medical Image Segmentation Techniques
  4. CPlaNet: Enhancing Image Geolocalization by Combinatorial Partitioning of Maps
    2018/08/06 by Paul Hongsuck Seo, Tobias Weyand, Seo, Paul Hongsuck +5 · 11 citations
    Computer Science · #Advanced Image and Video Retrieval Techniques #Multimodal Machine Learning Applications #Video Surveillance and Tracking Methods
  5. Zero-shot Referring Image Segmentation with Global-Local Context Features
    2023/03/31 by Seonghoon Yu, Paul Hongsuck Seo, Yu, Seonghoon +3 · 9 citations
    Arts and Humanities · Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Multimodal Machine Learning Applications #Natural Language Processing Techniques #Subtitles and Audiovisual Media
  6. Learning Audio-Video Modalities from Image Captions
    2022/04/01 by Arsha Nagrani, Paul Hongsuck Seo, Nagrani, Arsha +11 · 5 citations
    Computer Science · Biochemistry, Genetics and Molecular Biology · #Music and Audio Processing #Video Analysis and Summarization #Cancer-related molecular mechanisms research
  7. Towards Open-Vocabulary Semantic Segmentation Without Semantic Labels
    2024/09/30 by Heeseong Shin, Shin, Heeseong, Sunghwan Hong +10 · 7 citations
    Computer Science · #Natural Language Processing Techniques #Topic Modeling #Speech and dialogue systems
  8. Pseudo-RIS: Distinctive Pseudo-supervision Generation for Referring Image Segmentation
    2024/07/10 by Seonghoon Yu, Yu, Seonghoon, Paul Hongsuck Seo +3 · 3 citations
    Computer Science · Neuroscience · #Advanced Image and Video Retrieval Techniques #Artificial Intelligence (cs.AI) #Brain Tumor Detection and Classification #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Image Retrieval and Classification Techniques
  9. Seg4Diff: Unveiling Open-Vocabulary Segmentation in Text-to-Image Diffusion Transformers
    2025/09/22 by Kim, Chaehyun, Heeseong Shin, Shin, Heeseong +11 · 6 citations
    Computer Science · #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Natural Language Processing Techniques