vix.ing · top · new · best · stats · spec

Wei‐Hsiang Liao

  1. Consistency Trajectory Models: Learning Probability Flow ODE Trajectory of Diffusion
    2023/10/01 by Dongjun Kim, Kim, Dongjun, Chieh-Hsin Lai +15 · 132 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Machine Learning and Algorithms #Machine Learning and Data Classification
  2. Manifold Preserving Guided Diffusion
    2023/11/28 by Yutong He, He, Yutong, Naoki Murata +19 · 43 citations
    Computer Science · Physics and Astronomy · #Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Generative Adversarial Networks and Image Synthesis #Machine Learning (cs.LG) #Model Reduction and Neural Networks
  3. Automatic Piano Transcription with Hierarchical Frequency-Time Transformer
    2023/07/10 by Keisuke Toyama, Toyama, Keisuke, Taketo Akama +9 · 11 citations
    Arts and Humanities · Computer Science · #Audio and Speech Processing (eess.AS) #Diverse Musicological Studies #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Music Technology and Sound Studies #Music and Audio Processing #Sound (cs.SD) #electronic engineering #information engineering
  4. MusicMagus: Zero-Shot Text-to-Music Editing via Diffusion Models
    2024/02/09 by Yixiao Zhang, Yukara Ikemiya, Zhang, Yixiao +13 · 13 citations
    Computer Science · #Music and Audio Processing #Music Technology and Sound Studies #Speech Recognition and Synthesis
  5. Automatic music mixing with deep learning and out-of-domain data
    2022/08/24 by Marco A. Martínez-Ramírez, Wei‐Hsiang Liao, Martínez-Ramírez, Marco A. +9 · 10 citations
    Computer Science · #Music and Audio Processing #Music Technology and Sound Studies #Speech and Audio Processing
  6. HQ-VAE: Hierarchical Discrete Representation Learning with Variational Bayes
    2023/12/31 by Yuhta Takida, Takida, Yuhta, Yukara Ikemiya +19 · 10 citations
    Computer Science · Biochemistry, Genetics and Molecular Biology · #Image and Signal Denoising Methods #AI in cancer detection #Cancer-related molecular mechanisms research
  7. Music Mixing Style Transfer: A Contrastive Learning Approach to Disentangle Audio Effects
    2022/11/04 by Junghyun Koo, Marco A. Martinez-Ramirez, Koo, Junghyun +9 · 10 citations
    Computer Science · Engineering · #Advanced Adaptive Filtering Techniques #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Music and Audio Processing #Sound (cs.SD) #Speech and Audio Processing #electronic engineering #information engineering
  8. PaGoDA: Progressive Growing of a One-Step Generator from a Low-Resolution Diffusion Teacher
    2024/05/23 by Dongjun Kim, Chieh-Hsin Lai, Kim, Dongjun +13 · 9 citations
    Computer Science · #Advanced Data Compression Techniques #Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #Educational Technology and Assessment #FOS: Computer and information sciences #Machine Learning (cs.LG) #Machine Learning (stat.ML)
  9. Preventing Oversmoothing in VAE via Generalized Variance Parameterization
    2021/02/17 by Yuhta Takida, Takida, Yuhta, Wei‐Hsiang Liao +9 · 3 citations
    Computer Science · #AI in cancer detection #Computer Vision and Pattern Recognition (cs.CV) #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Generative Adversarial Networks and Image Synthesis #Machine Learning (cs.LG)
  10. Latent Diffusion Bridges for Unsupervised Musical Audio Timbre Transfer
    2024/01/01 by Michele Mancusi, Mancusi, Michele, Yurii Halychanskyi +20 · 1 voice · 3 citations
    Computer Science · Engineering · #Artificial Intelligence (cs.AI) #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Information Retrieval (cs.IR) #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #cs.AI #cs.IR #cs.SD #eess.AS #electronic engineering #information engineering
  11. Searching For Music Mixing Graphs: A Pruning Approach
    2024/06/03 by Sungho Lee, Marco A. Martínez-Ramírez, Lee, Sungho +11 · 6 citations
    Arts and Humanities · Computer Science · #Digital Humanities and Scholarship #FOS: Computer and information sciences #Music Technology and Sound Studies #Music and Audio Processing #Sound (cs.SD)
  12. OpenMU: Your Swiss Army Knife for Music Understanding
    2024/10/21 by Mengjie Zhao, Zhao, Mengjie, Zhi Zhong +13 · 5 citations
    Arts and Humanities · Computer Science · #Artificial Intelligence (cs.AI) #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #Diverse Musicological Studies #FOS: Computer and information sciences #FOS: Electrical engineering #Multimedia (cs.MM) #Music Technology and Sound Studies #Music and Audio Processing #Sound (cs.SD) #electronic engineering #information engineering
  13. SteerMusic: Enhanced Musical Consistency for Zero-shot Text-guided and Personalized Music Editing
    2025/04/15 by Xinlei Niu, Kin Wai Cheuk, Niu, Xinlei +19 · 5 citations
    Computer Science · #Artificial Intelligence in Games #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Multimedia (cs.MM) #Music Technology and Sound Studies #Music and Audio Processing #Sound (cs.SD) #electronic engineering #information engineering
  14. A Comprehensive Real-World Assessment of Audio Watermarking Algorithms: Will They Survive Neural Codecs?
    2025/05/26 by Yigitcan Özer, Woosung Choi, Özer, Yigitcan +9 · 6 citations
    Computer Science · #Advanced Steganography and Watermarking Techniques #Adversarial Robustness in Machine Learning #Artificial Intelligence (cs.AI) #Audio and Speech Processing (eess.AS) #Cryptography and Security (cs.CR) #Digital Media Forensic Detection #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Sound (cs.SD) #electronic engineering #information engineering
  15. Variable Bitrate Residual Vector Quantization for Audio Coding
    2024/10/08 by Yunkee Chae, Woosung Choi, Chae, Yunkee +19 · 4 citations
    Computer Science · #Advanced Data Compression Techniques #Audio and Speech Processing (eess.AS) #Digital Filter Design and Implementation #FOS: Computer and information sciences #FOS: Electrical engineering #Image and Signal Denoising Methods #Machine Learning (cs.LG) #Sound (cs.SD) #electronic engineering #information engineering
  16. DiffVox: A Differentiable Model for Capturing and Analysing Vocal Effects Distributions
    2025/04/20 by Chin-Yun Yu, Yu, Chin-Yun, Marco A. Martínez-Ramírez +11 · 5 citations
    Biochemistry, Genetics and Molecular Biology · #Animal Vocal Communication and Behavior #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
  17. GRAFX: An Open-Source Library for Audio Processing Graphs in PyTorch
    2024/08/06 by Sungho Lee, Marco A. Martínez-Ramírez, Lee, Sungho +11 · 3 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Music Technology and Sound Studies #Music and Audio Processing #Sound (cs.SD) #electronic engineering #information engineering
  18. On the Language Encoder of Contrastive Cross-modal Models
    2023/10/20 by Mengjie Zhao, Zhao, Mengjie, Junya Ono +17 · 1 citation
    Computer Science · Arts and Humanities · #Multimodal Machine Learning Applications #Domain Adaptation and Few-Shot Learning #Subtitles and Audiovisual Media
  19. MR-MT3: Memory Retaining Multi-Track Music Transcription to Mitigate Instrument Leakage
    2024/03/15 by Hao Tan, Tan, Hao Hao, Kin Wai Cheuk +7 · 1 citation
    Computer Science · #Music Technology and Sound Studies #Music and Audio Processing #Speech Recognition and Synthesis
  20. Improving Unsupervised Clean-to-Rendered Guitar Tone Transformation Using GANs and Integrated Unaligned Clean Data
    2024/06/22 by Yuhua Chen, Woosung Choi, Chen, Yu-Hua +13 · 1 citation
    Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Music Technology and Sound Studies #Music and Audio Processing #Sound (cs.SD) #Speech and Audio Processing #electronic engineering #information engineering
  21. Automatic DJ Transitions with Differentiable Audio Effects and Generative Adversarial Networks
    2021/10/13 by Boyu Chen, Chen, Bo-Yu, Wei‐Han Hsu +9 · 1 citation
    Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Music Technology and Sound Studies #Music and Audio Processing #Sound (cs.SD) #Speech and Audio Processing #electronic engineering #information engineering
  22. Cross-Modal Learning for Music-to-Music-Video Description Generation
    2025/03/14 by Zhuoyuan Mao, Mao, Zhuoyuan, Mengjie Zhao +11 · 1 citation
    Computer Science · #Artificial Intelligence (cs.AI) #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Multimedia (cs.MM) #Multimodal Machine Learning Applications #Music and Audio Processing #Sound (cs.SD) #Topic Modeling #electronic engineering #information engineering