Helin Wang
- Benchmarking Large Language Models on CMExam -- A Comprehensive Chinese Medical Exam Dataset
2023/06/05 by Junling Liu, Peilin Zhou, Liu, Junling +19 · 14 citations
Computer Science · Medicine · #Topic Modeling #Artificial Intelligence in Healthcare and Education #Machine Learning in Healthcare
- EzAudio: Enhancing Text-to-Audio Generation with Efficient Diffusion Transformer
2024/09/17 by Jiarui Hai, Yong Xu, Hai, Jiarui +11 · 14 citations
Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
- Enhancing Zero-shot Text-to-Speech Synthesis with Human Feedback
2024/06/02 by Chen Chen, Yuchen Hu, Chen, Chen +9 · 8 citations
Computer Science · Engineering · #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Robotics and Automated Systems #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and dialogue systems #electronic engineering #information engineering
- Audio Large Language Models Can Be Descriptive Speech Quality Evaluators
2025/01/27 by Chen Chen, Chen, Chen, Yuchen Hu +13 · 8 citations
Computer Science · #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
- Improving Target Sound Extraction with Timestamp Information
2022/04/02 by Helin Wang, Wang, Helin, Dongchao Yang +7 · 2 citations
Computer Science · Engineering · #Acoustic Wave Phenomena Research #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Sound (cs.SD) #Speech and Audio Processing #electronic engineering #information engineering
- SoloAudio: Target Sound Extraction with Language-oriented Audio Diffusion Transformer
2024/09/12 by Helin Wang, Jiarui Hai, Wang, Helin +9 · 4 citations
Computer Science · #Music and Audio Processing #Speech and Audio Processing #Speech Recognition and Synthesis
- NoreSpeech: Knowledge Distillation based Conditional Diffusion Model for Noise-robust Expressive TTS
2022/11/04 by Dongchao Yang, Songxiang Liu, Yang, Dongchao +9 · 1 citation
Computer Science · #Speech Recognition and Synthesis #Music and Audio Processing #Speech and Audio Processing
- SSR-Speech: Towards Stable, Safe and Robust Zero-shot Text-based Speech Editing and Synthesis
2024/09/11 by Helin Wang, Wang, Helin, Yu Meng +13 · 1 citation
Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
- TeCANet: Temporal-Contextual Attention Network for Environment-Aware Speech Dereverberation
2021/03/31 by Helin Wang, Wang, Helin, Bo Wu +17 · 1 citation
Computer Science · Neuroscience · #Speech and Audio Processing #Hearing Loss and Rehabilitation #Music and Audio Processing