vix.ing · top · new · best · stats · spec

Jaehun Kim

  1. FreGrad: Lightweight and Fast Frequency-aware Diffusion Vocoder
    2024/01/18 by Tan Dat Nguyen, Nguyen, Tan Dat, Ji‐Hoon Kim +7 · 8 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Signal Processing (eess.SP) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  2. One Deep Music Representation to Rule Them All? : A comparative analysis of different representation learning strategies
    2018/02/12 by Jaehun Kim, Kim, Jaehun, Julián Urbano +5 · 1 citation
    Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Music Technology and Sound Studies #Music and Audio Processing #Neural and Evolutionary Computing (cs.NE) #Sound (cs.SD) #Speech and Audio Processing #electronic engineering #information engineering
  3. Similar but Faster: Manipulation of Tempo in Music Audio Embeddings for Tempo Prediction and Search
    2024/01/17 by Matthew McCallum, McCallum, Matthew C., Florian Henkel +7 · 2 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #Digital Libraries (cs.DL) #FOS: Computer and information sciences #FOS: Electrical engineering #Information Retrieval (cs.IR) #Machine Learning (cs.LG) #Music Technology and Sound Studies #Music and Audio Processing #Sound (cs.SD) #Speech and Audio Processing #electronic engineering #information engineering
  4. AdaptVC: High Quality Voice Conversion with Adaptive Learning
    2025/01/02 by Jaehun Kim, Ji‐Hoon Kim, Kim, Jaehun +9 · 2 citations
    Computer Science · #Advanced Data Compression Techniques #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  5. From Faces to Voices: Learning Hierarchical Representations for High-quality Video-to-Speech
    2025/03/21 by Jihoon Kim, Kim, Ji-Hoon, Jeongsoo Choi +7 · 3 citations
    Computer Science · #Face recognition and analysis #Speech and Audio Processing #Generative Adversarial Networks and Image Synthesis
  6. Seeing Through the Conversation: Audio-Visual Speech Separation based on Diffusion Model
    2023/10/30 by Su‐Yeon Lee, Chaeyoung Jung, Lee, Suyeon +7 · 1 citation
    Computer Science · Engineering · Neuroscience · #Advanced Adaptive Filtering Techniques #Audio and Speech Processing (eess.AS) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #FOS: Electrical engineering #Hearing Loss and Rehabilitation #Sound (cs.SD) #Speech and Audio Processing #electronic engineering #information engineering
  7. Tempo estimation as fully self-supervised binary classification
    2024/01/17 by Florian Henkel, Jaehun Kim, Henkel, Florian +7 · 1 citation
    Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Music Technology and Sound Studies #Music and Audio Processing #Sound (cs.SD) #Speech and Audio Processing #electronic engineering #information engineering