vix.ing · top · new · best · stats · spec

Timo Gerkmann

  1. Speech Enhancement and Dereverberation with Diffusion-based Generative Models
    2022/08/11 by Julius Richter, Simon Welker, Richter, Julius +7 · 72 citations
    Computer Science · Engineering · #Speech and Audio Processing #Acoustic Wave Phenomena Research #Advanced Adaptive Filtering Techniques
  2. EARS: An Anechoic Fullband Speech Dataset Benchmarked for Speech Enhancement and Dereverberation
    2024/06/10 by Julius Richter, Richter, Julius, Yi-Chiao Wu +13 · 52 citations
    Computer Science · Health Professions · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Infant Health and Development #Machine Learning (cs.LG) #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  3. Speech Enhancement with Score-Based Generative Models in the Complex STFT Domain
    2022/03/31 by Simon Welker, Julius Richter, Welker, Simon +3 · 23 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Music Technology and Sound Studies #Music and Audio Processing #Sound (cs.SD) #Speech and Audio Processing #electronic engineering #information engineering
  4. Diffusion Models for Audio Restoration: A review
    2024/11/01 by Jean-Marie Lemercier, Julius Richter, Simon Welker +3 · 1 voice · 20 citations
    Computer Science · #Music and Audio Processing
  5. Reducing the Prior Mismatch of Stochastic Differential Equations for Diffusion-based Speech Enhancement
    2023/02/28 by Bunlong Lay, Lay, Bunlong, Simon Welker +5 · 10 citations
    Computer Science · Engineering · #Advanced Adaptive Filtering Techniques #Advanced MIMO Systems Optimization #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Sound (cs.SD) #Speech and Audio Processing #electronic engineering #information engineering
  6. Investigating Training Objectives for Generative Speech Enhancement
    2024/09/16 by Julius Richter, Danilo de Oliveira, Richter, Julius +3 · 14 citations
    Computer Science · Psychology · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Phonetics and Phonology Research #Sound (cs.SD) #Speech and Audio Processing #electronic engineering #information engineering
  7. Single and Few-step Diffusion for Generative Speech Enhancement
    2023/09/18 by Bunlong Lay, Lay, Bunlong, Jean-Marie Lemercier +5 · 8 citations
    Computer Science · Engineering · #Acoustic Wave Phenomena Research #Artificial Intelligence (cs.AI) #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  8. The PESQetarian: On the Relevance of Goodhart's Law for Speech Enhancement
    2024/06/05 by Danilo de Oliveira, Simon Welker, de Oliveira, Danilo +5 · 8 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Hate Speech and Cyberbullying Detection #Machine Learning (cs.LG) #Sound (cs.SD) #electronic engineering #information engineering
  9. Speech Separation Using an Asynchronous Fully Recurrent Convolutional Neural Network
    2021/12/04 by Xiaolin Hu, Kai Li, Hu, Xiaolin +9 · 4 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  10. Unsupervised Blind Joint Dereverberation and Room Acoustics Estimation with Diffusion Models
    2024/08/14 by Jean-Marie Lemercier, Lemercier, Jean-Marie, Eloi Moliner +7 · 7 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  11. On the Role of Spatial, Spectral, and Temporal Processing for DNN-based Non-linear Multi-channel Speech Enhancement
    2022/06/22 by Kristina Tesch, Nils-Hendrik Mohrmann, Tesch, Kristina +3 · 3 citations
    Computer Science · Engineering · #Advanced Adaptive Filtering Techniques #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Indoor and Outdoor Localization Technologies #Machine Learning (cs.LG) #Sound (cs.SD) #Speech and Audio Processing #electronic engineering #information engineering
  12. BUDDy: Single-Channel Blind Unsupervised Dereverberation with Diffusion Models
    2024/05/07 by Eloi Moliner, Moliner, Eloi, Jean-Marie Lemercier +7 · 5 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #Blind Source Separation Techniques #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  13. FlowDec: A flow-based full-band general audio codec with high perceptual quality
    2025/03/03 by Simon Welker, Matthew Le, Welker, Simon +11 · 11 citations
    Computer Science · Engineering · #Advanced Data Compression Techniques #Speech and Audio Processing #Advanced Adaptive Filtering Techniques
  14. HRTF Estimation using a Score-based Prior
    2024/10/02 by Etienne Thuillier, Jean-Marie Lemercier, Thuillier, Etienne +7 · 3 citations
    Medicine · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Hemodynamic Monitoring and Therapy #Machine Learning (cs.LG) #Sound (cs.SD) #electronic engineering #information engineering
  15. Speech Signal Improvement Using Causal Generative Diffusion Models
    2023/03/15 by Julius Richter, Simon Welker, Richter, Julius +9 · 1 citation
    Computer Science · Psychology · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Phonetics and Phonology Research #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  16. Extending DNN-based Multiplicative Masking to Deep Subband Filtering for Improved Dereverberation
    2023/03/01 by Jean-Marie Lemercier, Lemercier, Jean-Marie, Julian Tobergte +3 · 1 citation
    Computer Science · Engineering · #Acoustic Wave Phenomena Research #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Sound (cs.SD) #Speech and Audio Processing #Ultrasonics and Acoustic Wave Propagation #electronic engineering #information engineering
  17. Wind Noise Reduction with a Diffusion-based Stochastic Regeneration Model
    2023/06/22 by Jean-Marie Lemercier, Joachim Thiemann, Lemercier, Jean-Marie +5 · 1 citation
    Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Music Technology and Sound Studies #Music and Audio Processing #Sound (cs.SD) #Speech and Audio Processing #electronic engineering #information engineering
  18. An Analysis of the Variance of Diffusion-based Speech Enhancement
    2024/02/01 by Bunlong Lay, Timo Gerkmann, Lay, Bunlong +1 · 2 citations
    Computer Science · Engineering · #Advanced Adaptive Filtering Techniques #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Face recognition and analysis #Machine Learning (cs.LG) #Sound (cs.SD) #Speech and Audio Processing #electronic engineering #information engineering
  19. Diffusion Buffer: Online Diffusion-based Speech Enhancement with Sub-Second Latency
    2025/06/03 by Bunlong Lay, Rostislav Makarov, Lay, Bunlong +3 · 4 citations
    Computer Science · Engineering · #Advanced Adaptive Filtering Techniques #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  20. Non-intrusive Speech Quality Assessment with Diffusion Models Trained on Clean Speech
    2024/10/23 by Danilo de Oliveira, de Oliveira, Danilo, Julius Richter +7 · 1 citation
    Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Sound (cs.SD) #Speech and Audio Processing #electronic engineering #information engineering
  21. Steering Deep Non-Linear Spatially Selective Filters for Weakly Guided Extraction of Moving Speakers in Dynamic Scenarios
    2025/05/20 by Jakob Kienegger, Kienegger, Jakob, Timo Gerkmann +1 · 2 citations
    Computer Science · #Speech and Audio Processing #Speech Recognition and Synthesis #Music and Audio Processing