Jin, Zengrui
- Zipformer: A faster and better encoder for automatic speech recognition
2023/10/17 by Zengwei Yao, Yao, Zengwei, Liyong Guo +14 · 24 citations
Computer Science · #Speech Recognition and Synthesis #Music and Audio Processing #Natural Language Processing Techniques
- Enhancing Pre-trained ASR System Fine-tuning for Dysarthric Speech Recognition using Adversarial Data Augmentation
2024/01/01 by Wang, Huimeng, Jin, Zengrui, Geng, Mengzhe +5 · 4 citations
#Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
- Empowering Whisper as a Joint Multi-Talker and Target-Talker Speech Recognition System
2024/07/13 by Lingwei Meng, Meng, Lingwei, Jiawen Kang +11 · 5 citations
Computer Science · Environmental Science · #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #Educational Reforms and Innovations #FOS: Computer and information sciences #FOS: Electrical engineering #Hate Speech and Cyberbullying Detection #Sound (cs.SD) #electronic engineering #information engineering
- Advancing Multi-talker ASR Performance with Large Language Models
2024/08/30 by Mohan Shi, Zengrui Jin, Shi, Mohan +14 · 4 citations
Computer Science · #Artificial Intelligence (cs.AI) #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Speech Recognition and Synthesis #Speech and dialogue systems #electronic engineering #information engineering
- k2SSL: A Faster and Better Framework for Self-Supervised Speech Representation Learning
2024/11/26 by Yifan Yang, Yang, Yifan, Jianheng Zhuo +20 · 4 citations
Computer Science · #Speech Recognition and Synthesis #Music and Audio Processing #Speech and Audio Processing
- CR-CTC: Consistency regularization on CTC for improved speech recognition
2024/10/07 by Yao, Zengwei, Kang, Wei, Yang, Xiaoyu +7 · 4 citations
#Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Sound (cs.SD) #electronic engineering #information engineering
- Self-supervised ASR Models and Features For Dysarthric and Elderly Speech Recognition
2024/07/03 by Shujie Hu, Hu, Shujie, Xurong Xie +19 · 4 citations
Computer Science · Medicine · #Speech Recognition and Synthesis #Voice and Speech Disorders
- Personalized Adversarial Data Augmentation for Dysarthric and Elderly Speech Recognition
2022/05/13 by Jin, Zengrui, Geng, Mengzhe, Deng, Jiajun +4 · 1 citation
#Artificial Intelligence (cs.AI) #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #electronic engineering #information engineering
- LibriheavyMix: A 20,000-Hour Dataset for Single-Channel Reverberant Multi-Talker Speech Separation, ASR and Speaker Diarization
2024/09/01 by Zengrui Jin, Jin, Zengrui, Yifan Yang +22 · 2 citations
Computer Science · Health Professions · #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Infant Health and Development #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
- Adversarial Data Augmentation Using VAE-GAN for Disordered Speech Recognition
2022/11/03 by Jin, Zengrui, Xie, Xurong, Geng, Mengzhe +5 · 1 citation
#Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
- Audio-visual End-to-end Multi-channel Speech Separation, Dereverberation and Recognition
2023/07/06 by Guinan Li, Li, Guinan, Jiajun Deng +15 · 1 citation
Computer Science · Engineering · #Speech and Audio Processing #Advanced Adaptive Filtering Techniques #Blind Source Separation Techniques
- Factorised Speaker-environment Adaptive Training of Conformer Speech Recognition Systems
2023/06/26 by Deng, Jiajun, Li, Guinan, Xie, Xurong +6 · 1 citation
#Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #electronic engineering #information engineering
- Towards Automatic Data Augmentation for Disordered Speech Recognition
2023/12/14 by Jin, Zengrui, Xie, Xurong, Wang, Tianzi +5 · 1 citation
#Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
- Hyper-parameter Adaptation of Conformer ASR Systems for Elderly and Dysarthric Speech Recognition
2023/06/27 by Tianzi Wang, Shoukang Hu, Wang, Tianzi +13 · 1 citation
Computer Science · Medicine · Psychology · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Phonetics and Phonology Research #Speech Recognition and Synthesis #Voice and Speech Disorders #electronic engineering #information engineering
- Conformer Based Elderly Speech Recognition System for Alzheimer's Disease Detection
2022/06/23 by Tianzi Wang, Wang, Tianzi, Jiajun Deng +17 · 1 citation
Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Sound (cs.SD) #Speech Recognition and Synthesis #electronic engineering #information engineering
- Towards Effective and Efficient Non-autoregressive Decoding Using Block-based Attention Mask
2024/06/14 by Tianzi Wang, Xurong Xie, Wang, Tianzi +21 · 2 citations
Computer Science · #Artificial Intelligence (cs.AI) #Audio and Speech Processing (eess.AS) #Blind Source Separation Techniques #Digital Media Forensic Detection #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #Speech and Audio Processing #electronic engineering #information engineering
- Speech-Audio Compositional Attacks on Multimodal LLMs and Their Mitigation with SALMONN-Guard
2025/11/13 by Yudong Yang, Yang, Yudong, Xuezhen Zhang +14 · 3 citations
Computer Science · #Adversarial Robustness in Machine Learning #User Authentication and Security Systems #Music and Audio Processing
- Confidence Score Based Conformer Speaker Adaptation for Speech Recognition
2022/06/24 by Jiajun Deng, Xurong Xie, Deng, Jiajun +17 · 1 citation
Computer Science · #Advanced Data Compression Techniques #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering