Zmolikova, Katerina
- Improving speaker discrimination of target speech extraction with time-domain SpeakerBeam
2020/01/23 by Marc Delcroix, Tsubasa Ochiai, Delcroix, Marc +11 · 12 citations
Computer Science · #Speech and Audio Processing #Music and Audio Processing #Speech Recognition and Synthesis
- Integration of variational autoencoder and spatial clustering for adaptive multi-channel neural speech separation
2020/11/24 by Zmolikova, Katerina, Delcroix, Marc, Burget, Lukáš +2 · 1 citation
#Audio and Speech Processing (eess.AS) #FOS: Electrical engineering #electronic engineering #information engineering
- Listen only to me! How well can target speech extraction handle false alarms?
2022/04/11 by Marc Delcroix, Keisuke Kinoshita, Delcroix, Marc +9 · 1 citation
Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
- Textless Streaming Speech-to-Speech Translation using Semantic Speech Tokens
2024/10/04 by Jinzheng Zhao, Niko Moritz, Zhao, Jinzheng +17 · 1 citation
Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Electrical engineering #Natural Language Processing Techniques #Speech Recognition and Synthesis #Speech and dialogue systems #electronic engineering #information engineering