Ryo Masumura
- A Transformer-based Audio Captioning Model with Keyword Estimation
2020/07/01 by Yuma Koizumi, Ryo Masumura, Koizumi, Yuma +7 · 1 citation
Computer Science · #Music and Audio Processing #Video Analysis and Summarization #Speech and Audio Processing
- Enrollment-less training for personalized voice activity detection
2021/06/23 by Naoki Makishima, Mana Ihori, Makishima, Naoki +9 · 1 citation
Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
- End-to-End Joint Target and Non-Target Speakers ASR
2023/06/04 by Ryo Masumura, Masumura, Ryo, Naoki Makishima +27 · 2 citations
Computer Science · #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #Speech and dialogue systems #electronic engineering #information engineering
- Alignment-Free Training for Transducer-based Multi-Talker ASR
2024/09/30 by Takafumi Moriya, Shota Horiguchi, Moriya, Takafumi +13 · 2 citations
Engineering · Computer Science · #Ultrasonics and Acoustic Wave Propagation #Fault Detection and Control Systems #Speech Recognition and Synthesis