vix.ing · top · new · best · stats · spec

Zhenhua Tan

  1. DoubleHelix: Structured Cross-Modal Fusion for Audio-Visual Speech Recognition with LLMs
    2026/07/31 by Ziwei Cheng, Zhenhua Tan, Zhuomin Zhu
    Computer Science · #cs.SD #cs.AI #msc:68T10 #acm:68T10