Kobayashi, Tetsunori
- Mask CTC: Non-Autoregressive End-to-End ASR with CTC and Mask Predict
2020/05/18 by Yosuke Higuchi, Shinji Watanabe, Higuchi, Yosuke +7 · 6 citations
Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Natural Language Processing Techniques #Sound (cs.SD) #Speech Recognition and Synthesis #electronic engineering #information engineering
- Harnessing the Zero-Shot Power of Instruction-Tuned Large Language Model in End-to-End Speech Recognition
2023/09/19 by Yosuke Higuchi, Higuchi, Yosuke, Tetsuji Ogawa +3 · 1 voice · 2 citations
Computer Science · Engineering · #Natural Language Processing Techniques #Speech Recognition and Synthesis #Topic Modeling #cs.CL #cs.SD #eess.AS
- Improved Mask-CTC for Non-Autoregressive End-to-End ASR
2020/10/26 by Higuchi, Yosuke, Inaguma, Hirofumi, Watanabe, Shinji +2 · 2 citations
#Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
- A Single Speech Enhancement Model Unifying Dereverberation, Denoising, Speaker Counting, Separation, and Extraction
2023/10/12 by Saijo, Kohei, Zhang, Wangyou, Wang, Zhong-Qiu +3 · 3 citations
#Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
- BERT Meets CTC: New Formulation of End-to-End Speech Recognition with Pre-trained Masked Language Model
2022/10/29 by Higuchi, Yosuke, Yan, Brian, Arora, Siddhant +3 · 2 citations
#Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #electronic engineering #information engineering
- Predictive Speech Recognition and End-of-Utterance Detection Towards Spoken Dialog Systems
2024/09/30 by Oswald Zink, Yosuke Higuchi, Zink, Oswald +7 · 3 citations
Computer Science · #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #Speech and dialogue systems #electronic engineering #information engineering
- Hierarchical Conditional End-to-End ASR with CTC and Multi-Granular Subword Units
2021/10/08 by Higuchi, Yosuke, Karube, Keita, Ogawa, Tetsuji +1 · 1 citation
#Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #electronic engineering #information engineering
- BECTRA: Transducer-based End-to-End ASR with BERT-Enhanced Encoder
2022/11/02 by Yosuke Higuchi, Higuchi, Yosuke, Tetsuji Ogawa +5 · 1 citation
Computer Science · #Speech Recognition and Synthesis #Natural Language Processing Techniques #Topic Modeling
- InterMPL: Momentum Pseudo-Labeling with Intermediate CTC Loss
2022/11/02 by Yosuke Higuchi, Higuchi, Yosuke, Tetsuji Ogawa +5 · 1 citation
Computer Science · #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering