vix.ing · top · new · best · stats · spec

Fujita, Yusuke

  1. CHiME-6 Challenge:Tackling Multispeaker Speech Recognition for Unsegmented Recordings
    2020/04/20 by Shinji Watanabe, Michael Mandel, Watanabe, Shinji +39 · 22 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  2. End-to-End Neural Speaker Diarization with Permutation-Free Objectives
    2019/09/12 by Yusuke Fujita, Naoyuki Kanda, Fujita, Yusuke +7 · 16 citations
    Computer Science · #Speech Recognition and Synthesis #Speech and Audio Processing #Music and Audio Processing
  3. End-to-End Neural Speaker Diarization with Self-attention
    2019/09/13 by Yusuke Fujita, Naoyuki Kanda, Fujita, Yusuke +9 · 10 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  4. End-to-End Speaker Diarization for an Unknown Number of Speakers with Encoder-Decoder Based Attractors
    2020/05/20 by Horiguchi, Shota, Fujita, Yusuke, Watanabe, Shinji +2 · 10 citations
    #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
  5. Universal Score-based Speech Enhancement with High Content Preservation
    2024/06/18 by Robin Scheibler, Yusuke Fujita, Scheibler, Robin +5 · 9 citations
    Computer Science · Engineering · #Speech and Audio Processing #Advanced Data Compression Techniques #Advanced Adaptive Filtering Techniques
  6. Online End-to-End Neural Diarization with Speaker-Tracing Buffer
    2020/06/04 by Xue, Yawen, Horiguchi, Shota, Fujita, Yusuke +2 · 3 citations
    #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
  7. Auxiliary Interference Speaker Loss for Target-Speaker Speech Recognition
    2019/06/26 by Naoyuki Kanda, Shota Horiguchi, Kanda, Naoyuki +9 · 2 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  8. The Hitachi-JHU DIHARD III System: Competitive End-to-End Neural Diarization and X-Vector Clustering Systems Combined by DOVER-Lap
    2021/02/02 by Horiguchi, Shota, Yalta, Nelson, Garcia, Paola +7 · 2 citations
    #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
  9. Audio Difference Learning for Audio Captioning
    2023/09/15 by Tatsuya Komatsu, Komatsu, Tatsuya, Yusuke Fujita +5 · 2 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Music and Audio Processing #Signal Processing (eess.SP) #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  10. Guided Source Separation Meets a Strong ASR Backend: Hitachi/Paderborn University Joint Investigation for Dinner Party ASR
    2019/05/29 by Naoyuki Kanda, Kanda, Naoyuki, Christoph Boeddeker +11 · 2 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  11. Simultaneous Speech Recognition and Speaker Diarization for Monaural Dialogue Recordings with Target-Speaker Acoustic Models
    2019/09/17 by Kanda, Naoyuki, Horiguchi, Shota, Fujita, Yusuke +3 · 1 citation
    #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
  12. End-to-End Neural Diarization: Reformulating Speaker Diarization as Simple Multi-label Classification
    2020/02/24 by Fujita, Yusuke, Watanabe, Shinji, Horiguchi, Shota +2 · 1 citation
    #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
  13. Speaker Diarization with Region Proposal Network
    2020/02/14 by Huang, Zili, Watanabe, Shinji, Fujita, Yusuke +4 · 1 citation
    #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
  14. Neural Speaker Diarization with Speaker-Wise Chain Rule
    2020/06/02 by Fujita, Yusuke, Watanabe, Shinji, Horiguchi, Shota +3 · 1 citation
    #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
  15. Block-Online Guided Source Separation
    2020/11/16 by Horiguchi, Shota, Fujita, Yusuke, Nagamatsu, Kenji · 1 citation
    #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Signal Processing (eess.SP) #Sound (cs.SD) #electronic engineering #information engineering
  16. Neural Diarization with Non-autoregressive Intermediate Attractors
    2023/03/13 by Fujita, Yusuke, Komatsu, Tatsuya, Scheibler, Robin +2 · 1 citation
    #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
  17. Keep Decoding Parallel with Effective Knowledge Distillation from Language Models to End-to-end Speech Recognisers
    2024/01/22 by Hentschel, Michael, Nishikawa, Yuta, Komatsu, Tatsuya +1 · 1 citation
    #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering