vix.ing · top · new · best · stats · spec

Xinlong Chen

  1. VidCapBench: A Comprehensive Benchmark of Video Captioning for Controllable Text-to-Video Generation
    2025/02/18 by Xinlong Chen, Yuanxing Zhang, Chen, Xinlong +17 · 9 citations
    Computer Science · #Multimodal Machine Learning Applications #Human Pose and Action Recognition #Video Analysis and Summarization
  2. Mavors: Multi-granularity Video Representation for Multimodal Large Language Model
    2025/04/14 by Yang Shi, Shi, Yang, Jiaheng Liu +26 · 10 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Natural Language Processing Techniques #Topic Modeling
  3. Attention-guided Self-reflection for Zero-shot Hallucination Detection in Large Language Models
    2025/01/17 by Qiang Liu, Xinlong Chen, Liu, Qiang +9 · 4 citations
    Medicine · Neuroscience · Computer Science · #Medical Imaging Techniques and Applications #Brain Tumor Detection and Classification #Anomaly Detection Techniques and Applications
  4. MME-VideoOCR: Evaluating OCR-Based Capabilities of Multimodal LLMs in Video Scenarios
    2025/05/27 by Yang Shi, Shi, Yang, Huanqian Wang +43 · 5 citations
    Computer Science · #Natural Language Processing Techniques #Video Analysis and Summarization #Speech and dialogue systems
  5. Curriculum-Enhanced Residual Soft An-Isotropic Normalization for Over-smoothness in Deep GNNs
    2023/12/13 by Jin Li, Li, Jin, Qirong Zhang +9 · 1 citation
    Computer Science · Neuroscience · Social Sciences · #Advanced Computing and Algorithms #Advanced Graph Neural Networks #Artificial Intelligence (cs.AI) #Brain Tumor Detection and Classification #FOS: Computer and information sciences #Machine Learning (cs.LG)
  6. ReBind: Multi-Reference Video Editing via Structured Instructions with Explicit Reference Relationships
    2026/07/16 by Xinyu Liu, Shihao Li, Weihong Lin +10 · 1 citation
    #cs.CV
  7. RefCaptioner: Multi-Reference Image-Grounded Video Captioning
    2026/07/30 by Tengfei Liu, Yang Shi, Yuran Wang +16
    Computer Science · #cs.CV