Timo Gerkmann
- Speech Enhancement and Dereverberation with Diffusion-based Generative Models
2022/08/11 by Julius Richter, Simon Welker, Richter, Julius +7 · 72 citations
Computer Science · Engineering · #Speech and Audio Processing #Acoustic Wave Phenomena Research #Advanced Adaptive Filtering Techniques
- EARS: An Anechoic Fullband Speech Dataset Benchmarked for Speech Enhancement and Dereverberation
2024/06/10 by Julius Richter, Richter, Julius, Yi-Chiao Wu +13 · 52 citations
Computer Science · Health Professions · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Infant Health and Development #Machine Learning (cs.LG) #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
- Speech Enhancement with Score-Based Generative Models in the Complex STFT Domain
2022/03/31 by Simon Welker, Julius Richter, Welker, Simon +3 · 23 citations
Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Music Technology and Sound Studies #Music and Audio Processing #Sound (cs.SD) #Speech and Audio Processing #electronic engineering #information engineering
- Diffusion Models for Audio Restoration: A review
2024/11/01 by Jean-Marie Lemercier, Julius Richter, Simon Welker +3 · 1 voice · 20 citations
Computer Science · #Music and Audio Processing
- Reducing the Prior Mismatch of Stochastic Differential Equations for Diffusion-based Speech Enhancement
2023/02/28 by Bunlong Lay, Lay, Bunlong, Simon Welker +5 · 10 citations
Computer Science · Engineering · #Advanced Adaptive Filtering Techniques #Advanced MIMO Systems Optimization #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Sound (cs.SD) #Speech and Audio Processing #electronic engineering #information engineering
- Investigating Training Objectives for Generative Speech Enhancement
2024/09/16 by Julius Richter, Danilo de Oliveira, Richter, Julius +3 · 14 citations
Computer Science · Psychology · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Phonetics and Phonology Research #Sound (cs.SD) #Speech and Audio Processing #electronic engineering #information engineering
- Single and Few-step Diffusion for Generative Speech Enhancement
2023/09/18 by Bunlong Lay, Lay, Bunlong, Jean-Marie Lemercier +5 · 8 citations
Computer Science · Engineering · #Acoustic Wave Phenomena Research #Artificial Intelligence (cs.AI) #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
- The PESQetarian: On the Relevance of Goodhart's Law for Speech Enhancement
2024/06/05 by Danilo de Oliveira, Simon Welker, de Oliveira, Danilo +5 · 8 citations
Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Hate Speech and Cyberbullying Detection #Machine Learning (cs.LG) #Sound (cs.SD) #electronic engineering #information engineering
- Speech Separation Using an Asynchronous Fully Recurrent Convolutional Neural Network
2021/12/04 by Xiaolin Hu, Kai Li, Hu, Xiaolin +9 · 4 citations
Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
- Unsupervised Blind Joint Dereverberation and Room Acoustics Estimation with Diffusion Models
2024/08/14 by Jean-Marie Lemercier, Lemercier, Jean-Marie, Eloi Moliner +7 · 7 citations
Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
- On the Role of Spatial, Spectral, and Temporal Processing for DNN-based Non-linear Multi-channel Speech Enhancement
2022/06/22 by Kristina Tesch, Nils-Hendrik Mohrmann, Tesch, Kristina +3 · 3 citations
Computer Science · Engineering · #Advanced Adaptive Filtering Techniques #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Indoor and Outdoor Localization Technologies #Machine Learning (cs.LG) #Sound (cs.SD) #Speech and Audio Processing #electronic engineering #information engineering
- BUDDy: Single-Channel Blind Unsupervised Dereverberation with Diffusion Models
2024/05/07 by Eloi Moliner, Moliner, Eloi, Jean-Marie Lemercier +7 · 5 citations
Computer Science · #Audio and Speech Processing (eess.AS) #Blind Source Separation Techniques #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
- FlowDec: A flow-based full-band general audio codec with high perceptual quality
2025/03/03 by Simon Welker, Matthew Le, Welker, Simon +11 · 11 citations
Computer Science · Engineering · #Advanced Data Compression Techniques #Speech and Audio Processing #Advanced Adaptive Filtering Techniques
- HRTF Estimation using a Score-based Prior
2024/10/02 by Etienne Thuillier, Jean-Marie Lemercier, Thuillier, Etienne +7 · 3 citations
Medicine · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Hemodynamic Monitoring and Therapy #Machine Learning (cs.LG) #Sound (cs.SD) #electronic engineering #information engineering
- Speech Signal Improvement Using Causal Generative Diffusion Models
2023/03/15 by Julius Richter, Simon Welker, Richter, Julius +9 · 1 citation
Computer Science · Psychology · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Phonetics and Phonology Research #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
- Extending DNN-based Multiplicative Masking to Deep Subband Filtering for Improved Dereverberation
2023/03/01 by Jean-Marie Lemercier, Lemercier, Jean-Marie, Julian Tobergte +3 · 1 citation
Computer Science · Engineering · #Acoustic Wave Phenomena Research #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Sound (cs.SD) #Speech and Audio Processing #Ultrasonics and Acoustic Wave Propagation #electronic engineering #information engineering
- Wind Noise Reduction with a Diffusion-based Stochastic Regeneration Model
2023/06/22 by Jean-Marie Lemercier, Joachim Thiemann, Lemercier, Jean-Marie +5 · 1 citation
Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Music Technology and Sound Studies #Music and Audio Processing #Sound (cs.SD) #Speech and Audio Processing #electronic engineering #information engineering
- An Analysis of the Variance of Diffusion-based Speech Enhancement
2024/02/01 by Bunlong Lay, Timo Gerkmann, Lay, Bunlong +1 · 2 citations
Computer Science · Engineering · #Advanced Adaptive Filtering Techniques #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Face recognition and analysis #Machine Learning (cs.LG) #Sound (cs.SD) #Speech and Audio Processing #electronic engineering #information engineering
- Diffusion Buffer: Online Diffusion-based Speech Enhancement with Sub-Second Latency
2025/06/03 by Bunlong Lay, Rostislav Makarov, Lay, Bunlong +3 · 4 citations
Computer Science · Engineering · #Advanced Adaptive Filtering Techniques #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
- Non-intrusive Speech Quality Assessment with Diffusion Models Trained on Clean Speech
2024/10/23 by Danilo de Oliveira, de Oliveira, Danilo, Julius Richter +7 · 1 citation
Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Sound (cs.SD) #Speech and Audio Processing #electronic engineering #information engineering
- Steering Deep Non-Linear Spatially Selective Filters for Weakly Guided Extraction of Moving Speakers in Dynamic Scenarios
2025/05/20 by Jakob Kienegger, Kienegger, Jakob, Timo Gerkmann +1 · 2 citations
Computer Science · #Speech and Audio Processing #Speech Recognition and Synthesis #Music and Audio Processing