vix.ing · top · new · best · stats · spec

Huang, Zili

  1. SUPERB: Speech processing Universal PERformance Benchmark
    2021/05/03 by Shu-Wen Yang, Yang, Shu-wen, Po-Han Chi +37 · 69 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Natural Language Processing Techniques #Sound (cs.SD) #Speech Recognition and Synthesis #Topic Modeling #electronic engineering #information engineering
  2. Integration of speech separation, diarization, and recognition for multi-speaker meetings: System description, comparison, and analysis
    2020/11/03 by Raj, Desh, Denisov, Pavel, Chen, Zhuo +11 · 11 citations
    #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
  3. A Large-Scale Evaluation of Speech Foundation Models
    2024/04/15 by Yang, Shu-wen, Chang, Heng-Jui, Huang, Zili +18 · 14 citations
    #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Signal Processing (eess.SP) #electronic engineering #information engineering
  4. SUPERB-SG: Enhanced Speech processing Universal PERformance Benchmark for Semantic and Generative Capabilities
    2022/03/14 by Tsai, Hsiang-Sheng, Chang, Heng-Jui, Huang, Wen-Chin +14 · 7 citations
    #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
  5. DOVER-Lap: A Method for Combining Overlap-aware Diarization Outputs
    2020/11/03 by Raj, Desh, Garcia-Perera, Leibny Paola, Huang, Zili +4 · 4 citations
    #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
  6. Investigating self-supervised learning for speech enhancement and separation
    2022/03/15 by Huang, Zili, Shinji Watanabe, Shuwen Yang +6 · 3 citations
    Computer Science · Engineering · #Advanced Adaptive Filtering Techniques #Audio and Speech Processing (eess.AS) #FOS: Electrical engineering #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  7. Adapting self-supervised models to multi-talker speech recognition using speaker embeddings
    2022/11/01 by Zili Huang, Huang, Zili, Desh Raj +5 · 3 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Natural Language Processing Techniques #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and dialogue systems #electronic engineering #information engineering
  8. The Hitachi-JHU DIHARD III System: Competitive End-to-End Neural Diarization and X-Vector Clustering Systems Combined by DOVER-Lap
    2021/02/02 by Horiguchi, Shota, Yalta, Nelson, Garcia, Paola +7 · 2 citations
    #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
  9. Speaker Diarization with Region Proposal Network
    2020/02/14 by Huang, Zili, Watanabe, Shinji, Fujita, Yusuke +4 · 1 citation
    #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
  10. Target-speaker Voice Activity Detection with Improved I-Vector Estimation for Unknown Number of Speaker
    2021/08/07 by He, Maokui, Raj, Desh, Huang, Zili +3 · 1 citation
    #Audio and Speech Processing (eess.AS) #FOS: Electrical engineering #electronic engineering #information engineering
  11. SUPERB @ SLT 2022: Challenge on Generalization and Efficiency of Self-Supervised Speech Representation Learning
    2022/10/16 by Tzu-hsun Feng, Annie Dong, Feng, Tzu-hsun +25 · 1 citation
    Computer Science · #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Natural Language Processing Techniques #Sound (cs.SD) #Speech Recognition and Synthesis #electronic engineering #information engineering