vix.ing · top · new · best · stats · spec

Herremans, Dorien

  1. HEAR: Holistic Evaluation of Audio Representations
    2022/03/06 by Joseph Turian, Turian, Joseph, Jordie Shier +43 · 18 citations
    Computer Science · Neuroscience · #Artificial Intelligence (cs.AI) #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Hearing Loss and Rehabilitation #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #electronic engineering #information engineering
  2. Mustango: Toward Controllable Text-to-Music Generation
    2023/11/14 by Jan Melechovský, Zixun Guo, Melechovsky, Jan +9 · 23 citations
    Arts and Humanities · Computer Science · #Audio and Speech Processing (eess.AS) #Digital Humanities and Scholarship #FOS: Electrical engineering #Music Technology and Sound Studies #Music and Audio Processing #electronic engineering #information engineering
  3. MidiCaps: A Large-Scale MIDI Dataset With Text Captions
    2024/06/04 by Jan Melechovský, Melechovsky, Jan, Abhinaba Roy +3 · 6 citations
    Arts and Humanities · Computer Science · #Audio and Speech Processing (eess.AS) #Diverse Musicological Studies #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Multimedia (cs.MM) #Music Technology and Sound Studies #Music and Audio Processing #Sound (cs.SD) #electronic engineering #information engineering
  4. Learning Disentangled Representations of Timbre and Pitch for Musical Instrument Sounds Using Gaussian Mixture Variational Autoencoders
    2019/06/19 by Yin-Jyun Luo, Kat Agres, Luo, Yin-Jyun +3 · 4 citations
    Arts and Humanities · Computer Science · #Audio and Speech Processing (eess.AS) #Diverse Musicological Studies #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Music Technology and Sound Studies #Music and Audio Processing #Sound (cs.SD) #Speech and Audio Processing #electronic engineering #information engineering
  5. Text2midi: Generating Symbolic Music from Captions
    2024/12/21 by Keshav Bhandari, Abhinaba Roy, Bhandari, Keshav +9 · 9 citations
    Computer Science · Arts and Humanities · #Music and Audio Processing #Digital Humanities and Scholarship #Natural Language Processing Techniques
  6. Forecasting Bitcoin volatility spikes from whale transactions and CryptoQuant data using Synthesizer Transformer models
    2022/10/06 by Dorien Herremans, Kah Wee Low, Herremans, Dorien +1 · 3 citations
    Computer Science · Decision Sciences · Economics, Econometrics and Finance · #Artificial Intelligence (cs.AI) #Blockchain Technology Applications and Security #Complex Systems and Time Series Analysis #Computational Finance (q-fin.CP) #FOS: Computer and information sciences #FOS: Economics and business #Machine Learning (cs.LG) #Portfolio Management (q-fin.PM) #Stock Market Forecasting Methods #Trading and Market Microstructure (q-fin.TR)
  7. MusIAC: An extensible generative framework for Music Infilling Applications with multi-level Control
    2022/02/11 by Rui Guo, Ivor Simpson, Guo, Rui +7 · 2 citations
    Computer Science · Neuroscience · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Multimedia (cs.MM) #Music Technology and Sound Studies #Music and Audio Processing #Neuroscience and Music Perception
  8. Midi Miner -- A Python library for tonal tension and track\n classification
    2019/10/03 by Rui Guo, Guo, Rui, Dorien Herremans +3 · 2 citations
    Arts and Humanities · Computer Science · #Audio and Speech Processing (eess.AS) #Diverse Musicological Studies #FOS: Computer and information sciences #FOS: Electrical engineering #Information Retrieval (cs.IR) #Machine Learning (cs.LG) #Music Technology and Sound Studies #Music and Audio Processing #Sound (cs.SD) #Speech and Audio Processing #electronic engineering #information engineering
  9. Are We There Yet? A Brief Survey of Music Emotion Prediction Datasets, Models and Outstanding Challenges
    2024/06/13 by Kang, Jaeyong, Herremans, Dorien · 3 citations
    #Artificial Intelligence (cs.AI) #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
  10. Singing Voice Separation Using a Deep Convolutional Neural Network\n Trained by Ideal Binary Mask and Cross Entropy
    2018/12/04 by Kin Wah Edward Lin, Lin, Kin Wah Edward, B T Balamurali +7 · 1 citation
    Computer Science · #Speech and Audio Processing #Music and Audio Processing #Speech Recognition and Synthesis
  11. Singing Voice Conversion with Disentangled Representations of Singer and Vocal Technique Using Variational Autoencoders
    2019/12/03 by Yin-Jyun Luo, C.C. Hsu, Luo, Yin-Jyun +5 · 1 citation
    Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  12. JamendoMaxCaps: A Large Scale Music-caption Dataset with Imputed Metadata
    2025/02/11 by Roy, Abhinaba, Liu, Renhang, Lu, Tongyu +1 · 5 citations
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Sound (cs.SD)
  13. A variational autoencoder for music generation controlled by tonal tension
    2020/10/13 by Guo, Rui, Simpson, Ivor, Magnusson, Thor +2 · 1 citation
    #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #Symbolic Computation (cs.SC) #electronic engineering #information engineering
  14. Generating Lead Sheets with Affect: A Novel Conditional seq2seq Framework
    2021/04/27 by Makris, Dimos, Agres, Kat R., Herremans, Dorien · 1 citation
    #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Sound (cs.SD) #electronic engineering #information engineering
  15. Deep Neural Network Based Respiratory Pathology Classification Using Cough Sounds
    2021/06/23 by T, Balamurali B, Hee, Hwan Ing, Kapoor, Saumitra +5 · 1 citation
    #62-XX #68Txx #92-XX #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #I.2 #J.3 #Machine Learning (cs.LG) #Multimedia (cs.MM) #Sound (cs.SD) #electronic engineering #information engineering
  16. Towards Unified Music Emotion Recognition across Dimensional and Categorical Models
    2025/02/06 by Kang, Jaeyong, Herremans, Dorien · 3 citations
    #Artificial Intelligence (cs.AI) #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
  17. Accented Text-to-Speech Synthesis with a Conditional Variational Autoencoder
    2022/11/07 by Jan Melechovský, Melechovsky, Jan, Ambuj Mehrish +5 · 1 citation
    Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Natural Language Processing Techniques #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and dialogue systems #electronic engineering #information engineering
  18. DART: Disentanglement of Accent and Speaker Representation in Multispeaker Text-to-Speech
    2024/10/17 by Melechovsky, Jan, Mehrish, Ambuj, Sisman, Berrak +1 · 2 citations
    #Artificial Intelligence (cs.AI) #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
  19. Jointist: Simultaneous Improvement of Multi-instrument Transcription and Music Source Separation via Joint Training
    2023/02/01 by Kin Wai Cheuk, Keunwoo Choi, Cheuk, Kin Wai +13 · 1 citation
    Computer Science · #Artificial Intelligence (cs.AI) #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Music Technology and Sound Studies #Music and Audio Processing #Sound (cs.SD) #Speech and Audio Processing #electronic engineering #information engineering
  20. Text2midi-InferAlign: Improving Symbolic Music Generation with Inference-Time Alignment
    2025/05/19 by Roy, Abhinaba, Puri, Geeta, Herremans, Dorien · 3 citations
    #68T07 #Artificial Intelligence (cs.AI) #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #I.2.1 #Multimedia (cs.MM) #Sound (cs.SD) #electronic engineering #information engineering
  21. LLMs Can't Handle Peer Pressure: Crumbling under Multi-Agent Social Interactions
    2025/08/24 by Song, Maojia, Pala, Tej Deep, Jin, Weisheng +4 · 4 citations
    #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences
  22. JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment
    2025/07/28 by Liu, Renhang, Hung, Chia-Yu, Majumder, Navonil +5 · 2 citations
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Sound (cs.SD)
  23. BandCondiNet: Parallel Transformers-based Conditional Popular Music Generation with Multi-View Features
    2024/07/15 by Jing Luo, Luo, Jing, Xinyu Yang +3 · 1 citation
    Computer Science · Engineering · #Music Technology and Sound Studies #Music and Audio Processing #Human Motion and Animation
  24. Accent Conversion in Text-To-Speech Using Multi-Level VAE and Adversarial Training
    2024/06/03 by Melechovsky, Jan, Mehrish, Ambuj, Sisman, Berrak +1 · 1 citation
    #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Sound (cs.SD) #electronic engineering #information engineering
  25. DisfluencySpeech -- Single-Speaker Conversational Speech Dataset with Paralanguage
    2024/06/13 by Wang, Kyra, Herremans, Dorien · 1 citation
    #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #electronic engineering #information engineering
  26. DeepUnifiedMom: Unified Time-series Momentum Portfolio Construction via Multi-Task Learning with Multi-Gate Mixture of Experts
    2024/06/13 by J. M. Joel Ong, Dorien Herremans, Ong, Joel +1 · 1 citation
    Computer Science · Earth and Planetary Sciences · #Computational Finance (q-fin.CP) #Computational Physics and Python Applications #FOS: Economics and business #Meteorological Phenomena and Simulations #Time Series Analysis and Forecasting
  27. ImprovNet -- Generating Controllable Musical Improvisations with Iterative Corruption Refinement
    2025/02/06 by Bhandari, Keshav, Chang, Sungkyun, Lu, Tongyu +4 · 2 citations
    #Artificial Intelligence (cs.AI) #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
  28. NORA-1.5: A Vision-Language-Action Model Trained using World Model- and Action-based Preference Rewards
    2025/11/18 by Hung, Chia-Yu, Majumder, Navonil, Deng, Haoyuan +7 · 2 citations
    Computer Science · Psychology · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Multimodal Machine Learning Applications #Reinforcement Learning in Robotics #Robotics (cs.RO) #Social Robot Interaction and HRI