vix.ing · top · new · best · stats · spec

Jianxin Liang

  1. HawkEye: Training Video-Text LLMs for Grounding Text in Videos
    2024/03/15 by Yueqian Wang, Xiaojun Meng, Wang, Yueqian +8 · 21 citations
    Computer Science · #Natural Language Processing Techniques #Topic Modeling #Multimodal Machine Learning Applications
  2. VideoLLM Knows When to Speak: Enhancing Time-Sensitive Video Comprehension with Video-Text Duet Interaction Format
    2024/11/27 by Yueqian Wang, Wang, Yueqian, Xiaojun Meng +10 · 11 citations
    Social Sciences · #Educational Tools and Methods
  3. Efficient Temporal Extrapolation of Multimodal Large Language Models with Temporal Grounding Bridge
    2024/02/25 by Yuxuan Wang, Wang, Yuxuan, Yueqian Wang +9 · 7 citations
    Computer Science · #Computation and Language (cs.CL) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Human Pose and Action Recognition #Multimodal Machine Learning Applications #Video Analysis and Summarization
  4. Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding
    2024/12/23 by Yueqian Wang, Xiaojun Meng, Wang, Yueqian +9 · 2 citations
    Computer Science · Psychology · Health Professions · #Speech and dialogue systems #Language, Metaphor, and Cognition #Interpreting and Communication in Healthcare
  5. Pharmacological activation of STAT1-GSDME pyroptotic circuitry reinforces epigenetic immunotherapy for hepatocellular carcinoma
    2024/11/01 by Yalin Tu, Haoran Wu, Chengpeng Zhong +38 · 23 citations
    Biochemistry, Genetics and Molecular Biology · Medicine · Immunology and Microbiology · #Inflammasome and immune disorders #Cancer Immunotherapy and Biomarkers #Immune cells in cancer
  6. ReasVQA: Advancing VideoQA with Imperfect Reasoning Process
    2025/01/23 by Jianxin Liang, Liang, Jianxin, Xiaojun Meng +8 · 2 citations
    Computer Science · #Human Pose and Action Recognition #Multimodal Machine Learning Applications