vix.ing · top · new · best · stats · spec

Fazekas, György

  1. The Song Describer Dataset: a Corpus of Audio Captions for Music-and-Language Evaluation
    2023/11/16 by Ilaria Manco, Manco, Ilaria, Benno Weck +22 · 12 citations
    Computer Science · Arts and Humanities · #Music and Audio Processing #Music Technology and Sound Studies #Diverse Musicological Studies
  2. A Review of Differentiable Digital Signal Processing for Music & Speech Synthesis
    2023/08/29 by Hayes, Ben, Shier, Jordie, Fazekas, György +2 · 9 citations
    #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
  3. Foundation Models for Music: A Survey
    2024/08/26 by Yinghao Ma, Ma, Yinghao, Anders Øland +81 · 9 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Music Technology and Sound Studies #Sound (cs.SD) #electronic engineering #information engineering
  4. Contrastive Audio-Language Learning for Music
    2022/08/25 by Ilaria Manco, Manco, Ilaria, Emmanouil Benetos +5 · 4 citations
    Computer Science · Arts and Humanities · #Music and Audio Processing #Diverse Musicological Studies #Speech and Audio Processing
  5. Sinusoidal Frequency Estimation by Gradient Descent
    2022/10/26 by Ben J. Hayes, Charalampos Saitis, Hayes, Ben +3 · 4 citations
    Engineering · Computer Science · #Structural Health Monitoring Techniques #Neural Networks and Applications #Advanced Adaptive Filtering Techniques
  6. Neural Waveshaping Synthesis
    2021/07/11 by Ben J. Hayes, Charalampos Saitis, Hayes, Ben +3 · 2 citations
    Computer Science · #Music and Audio Processing #Music Technology and Sound Studies #Neural Networks and Applications
  7. A Tutorial on Deep Learning for Music Information Retrieval
    2017/09/13 by Keunwoo Choi, Choi, Keunwoo, György Fazekas +5 · 3 citations
    Computer Science · #Music and Audio Processing #Music Technology and Sound Studies #Generative Adversarial Networks and Image Synthesis
  8. Zero-Shot Duet Singing Voices Separation with Diffusion Models
    2023/11/13 by Yu, Chin-Yun, Postolache, Emilian, Rodolà, Emanuele +1 · 2 citations
    #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
  9. Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations
    2024/12/25 by Julien Guinot, Elio Quinton, Guinot, Julien +3 · 4 citations
    Neuroscience · Computer Science · #Neuroscience and Music Perception #Music and Audio Processing #Music Technology and Sound Studies
  10. A Feature Learning Siamese Model for Intelligent Control of the Dynamic Range Compressor
    2019/05/01 by Sheng, Di, Fazekas, György · 1 citation
    #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Sound (cs.SD) #electronic engineering #information engineering
  11. Audio synthesizer inversion in symmetric parameter spaces with approximately equivariant flow matching
    2025/06/08 by Ben Hayes, Ben J. Hayes, Hayes, Ben +4 · 1 voice · 4 citations
    Computer Science · #Music Technology and Sound Studies #Music and Audio Processing #Speech and Audio Processing #cs.LG #cs.SD #eess.AS #eess.SP
  12. Differentiable All-pole Filters for Time-varying Audio Systems
    2024/04/11 by Chin-Yun Yu, Yu, Chin-Yun, Christopher Mitcheltree +9 · 5 citations
    Computer Science · Engineering · #Speech and Audio Processing #Acoustic Wave Phenomena Research #Music and Audio Processing
  13. DoReMi: First glance at a universal OMR dataset
    2021/07/16 by Elona Shatri, György Fazekas, Shatri, Elona +1 · 1 citation
    Medicine · #Radiomics and Machine Learning in Medical Imaging
  14. Rigid-Body Sound Synthesis with Differentiable Modal Resonators
    2022/10/27 by Diaz, Rodrigo, Hayes, Ben, Saitis, Charalampos +2 · 1 citation
    #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Sound (cs.SD) #electronic engineering #information engineering
  15. AI as mediator between composers, sound designers, and creative media producers
    2023/03/02 by Sebastian Löbbers, Löbbers, Sebastian, Mathieu Barthet +3 · 1 citation
    Computer Science · Engineering · #Music Technology and Sound Studies #BIM and Construction Integration #Design Education and Practice
  16. Mesostructures: Beyond Spectrogram Loss in Differentiable Time-Frequency Analysis
    2023/01/24 by Cyrus Vahidi, Vahidi, Cyrus, Han Han +9 · 1 citation
    Computer Science · Engineering · #Acoustic Wave Phenomena Research #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Music Technology and Sound Studies #Music and Audio Processing #Sound (cs.SD) #electronic engineering #information engineering
  17. The Responsibility Problem in Neural Networks with Unordered Targets
    2023/04/19 by Ben J. Hayes, Charalampos Saitis, Hayes, Ben +3 · 1 citation
    Computer Science · #Adversarial Robustness in Machine Learning #Stochastic Gradient Optimization Techniques #Advanced Graph Neural Networks
  18. Composer Style-specific Symbolic Music Generation Using Vector Quantized Discrete Diffusion Models
    2023/10/21 by Zhang, Jincheng, Fazekas, György, Saitis, Charalampos · 1 citation
    #Artificial Intelligence (cs.AI) #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
  19. Fast Diffusion GAN Model for Symbolic Music Generation Controlled by Emotions
    2023/10/21 by Jincheng Zhang, György Fazekas, Zhang, Jincheng +3 · 1 citation
    Computer Science · Neuroscience · #Artificial Intelligence (cs.AI) #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Music Technology and Sound Studies #Music and Audio Processing #Neuroscience and Music Perception #Sound (cs.SD) #electronic engineering #information engineering
  20. DiffVox: A Differentiable Model for Capturing and Analysing Vocal Effects Distributions
    2025/04/20 by Chin-Yun Yu, Marco A. Martínez-Ramírez, Yu, Chin-Yun +11 · 2 citations
    Biochemistry, Genetics and Molecular Biology · #Animal Vocal Communication and Behavior #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering