Nagamatsu, Kenji
- End-to-End Neural Speaker Diarization with Permutation-Free Objectives
2019/09/12 by Yusuke Fujita, Fujita, Yusuke, Naoyuki Kanda +7 · 16 citations
Computer Science · #Speech Recognition and Synthesis #Speech and Audio Processing #Music and Audio Processing
- End-to-End Neural Speaker Diarization with Self-attention
2019/09/13 by Yusuke Fujita, Naoyuki Kanda, Fujita, Yusuke +9 · 10 citations
Computer Science · #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
- End-to-End Speaker Diarization for an Unknown Number of Speakers with Encoder-Decoder Based Attractors
2020/05/20 by Horiguchi, Shota, Fujita, Yusuke, Watanabe, Shinji +2 · 10 citations
#Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
- Online End-to-End Neural Diarization with Speaker-Tracing Buffer
2020/06/04 by Xue, Yawen, Horiguchi, Shota, Fujita, Yusuke +2 · 3 citations
#Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
- Auxiliary Interference Speaker Loss for Target-Speaker Speech Recognition
2019/06/26 by Naoyuki Kanda, Shota Horiguchi, Kanda, Naoyuki +9 · 2 citations
Computer Science · #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
- Guided Source Separation Meets a Strong ASR Backend: Hitachi/Paderborn University Joint Investigation for Dinner Party ASR
2019/05/29 by Naoyuki Kanda, Christoph Boeddeker, Kanda, Naoyuki +11 · 2 citations
Computer Science · #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
- Simultaneous Speech Recognition and Speaker Diarization for Monaural Dialogue Recordings with Target-Speaker Acoustic Models
2019/09/17 by Kanda, Naoyuki, Horiguchi, Shota, Fujita, Yusuke +3 · 1 citation
#Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
- End-to-End Neural Diarization: Reformulating Speaker Diarization as Simple Multi-label Classification
2020/02/24 by Fujita, Yusuke, Watanabe, Shinji, Horiguchi, Shota +2 · 1 citation
#Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
- Neural Speaker Diarization with Speaker-Wise Chain Rule
2020/06/02 by Fujita, Yusuke, Watanabe, Shinji, Horiguchi, Shota +3 · 1 citation
#Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
- Block-Online Guided Source Separation
2020/11/16 by Horiguchi, Shota, Fujita, Yusuke, Nagamatsu, Kenji · 1 citation
#Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Signal Processing (eess.SP) #Sound (cs.SD) #electronic engineering #information engineering