Fujita, Yusuke
- CHiME-6 Challenge:Tackling Multispeaker Speech Recognition for Unsegmented Recordings
2020/04/20 by Shinji Watanabe, Michael Mandel, Watanabe, Shinji +39 · 22 citations
Computer Science · #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
- End-to-End Neural Speaker Diarization with Permutation-Free Objectives
2019/09/12 by Yusuke Fujita, Naoyuki Kanda, Fujita, Yusuke +7 · 16 citations
Computer Science · #Speech Recognition and Synthesis #Speech and Audio Processing #Music and Audio Processing
- End-to-End Neural Speaker Diarization with Self-attention
2019/09/13 by Yusuke Fujita, Naoyuki Kanda, Fujita, Yusuke +9 · 10 citations
Computer Science · #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
- End-to-End Speaker Diarization for an Unknown Number of Speakers with Encoder-Decoder Based Attractors
2020/05/20 by Horiguchi, Shota, Fujita, Yusuke, Watanabe, Shinji +2 · 10 citations
#Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
- Universal Score-based Speech Enhancement with High Content Preservation
2024/06/18 by Robin Scheibler, Yusuke Fujita, Scheibler, Robin +5 · 9 citations
Computer Science · Engineering · #Speech and Audio Processing #Advanced Data Compression Techniques #Advanced Adaptive Filtering Techniques
- Online End-to-End Neural Diarization with Speaker-Tracing Buffer
2020/06/04 by Xue, Yawen, Horiguchi, Shota, Fujita, Yusuke +2 · 3 citations
#Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
- Auxiliary Interference Speaker Loss for Target-Speaker Speech Recognition
2019/06/26 by Naoyuki Kanda, Shota Horiguchi, Kanda, Naoyuki +9 · 2 citations
Computer Science · #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
- The Hitachi-JHU DIHARD III System: Competitive End-to-End Neural Diarization and X-Vector Clustering Systems Combined by DOVER-Lap
2021/02/02 by Horiguchi, Shota, Yalta, Nelson, Garcia, Paola +7 · 2 citations
#Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
- Audio Difference Learning for Audio Captioning
2023/09/15 by Tatsuya Komatsu, Komatsu, Tatsuya, Yusuke Fujita +5 · 2 citations
Computer Science · #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Music and Audio Processing #Signal Processing (eess.SP) #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
- Guided Source Separation Meets a Strong ASR Backend: Hitachi/Paderborn University Joint Investigation for Dinner Party ASR
2019/05/29 by Naoyuki Kanda, Kanda, Naoyuki, Christoph Boeddeker +11 · 2 citations
Computer Science · #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
- Simultaneous Speech Recognition and Speaker Diarization for Monaural Dialogue Recordings with Target-Speaker Acoustic Models
2019/09/17 by Kanda, Naoyuki, Horiguchi, Shota, Fujita, Yusuke +3 · 1 citation
#Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
- End-to-End Neural Diarization: Reformulating Speaker Diarization as Simple Multi-label Classification
2020/02/24 by Fujita, Yusuke, Watanabe, Shinji, Horiguchi, Shota +2 · 1 citation
#Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
- Speaker Diarization with Region Proposal Network
2020/02/14 by Huang, Zili, Watanabe, Shinji, Fujita, Yusuke +4 · 1 citation
#Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
- Neural Speaker Diarization with Speaker-Wise Chain Rule
2020/06/02 by Fujita, Yusuke, Watanabe, Shinji, Horiguchi, Shota +3 · 1 citation
#Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
- Block-Online Guided Source Separation
2020/11/16 by Horiguchi, Shota, Fujita, Yusuke, Nagamatsu, Kenji · 1 citation
#Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Signal Processing (eess.SP) #Sound (cs.SD) #electronic engineering #information engineering
- Neural Diarization with Non-autoregressive Intermediate Attractors
2023/03/13 by Fujita, Yusuke, Komatsu, Tatsuya, Scheibler, Robin +2 · 1 citation
#Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
- Keep Decoding Parallel with Effective Knowledge Distillation from Language Models to End-to-end Speech Recognisers
2024/01/22 by Hentschel, Michael, Nishikawa, Yuta, Komatsu, Tatsuya +1 · 1 citation
#Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering