vix.ing · top · new · best · stats · spec

Phan, Huy

  1. CHIP: CHannel Independence-based Pruning for Compact Neural Networks
    2021/10/26 by Sui, Yang, Yin, Miao, Xie, Yi +3 · 5 citations
    #Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Machine Learning (cs.LG)
  2. L-SeqSleepNet: Whole-cycle Long Sequence Modelling for Automatic Sleep Staging
    2023/01/09 by Phan, Huy, Lorenzen, Kristian P., Heremans, Elisabeth +7 · 3 citations
    #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Signal Processing (eess.SP) #electronic engineering #information engineering
  3. Adapting Language-Audio Models as Few-Shot Audio Learners
    2023/05/28 by Jinhua Liang, Xubo Liu, Liang, Jinhua +11 · 3 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  4. WavCraft: Audio Editing and Generation with Large Language Models
    2024/03/14 by Jinhua Liang, Liang, Jinhua, Huan Zhang +17 · 4 citations
    Computer Science · #Music and Audio Processing #Speech Recognition and Synthesis
  5. Robust Audio Event Recognition with 1-Max Pooling Convolutional Neural\n Networks
    2016/04/21 by Huy P. Phan, Lars Hertel, Phan, Huy +5 · 1 citation
    Computer Science · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Music and Audio Processing #Neural and Evolutionary Computing (cs.NE) #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing
  6. ATGNN: Audio Tagging Graph Neural Network
    2023/11/02 by Singh, Shubhr, Steinmetz, Christian J., Benetos, Emmanouil +2 · 2 citations
    #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Sound (cs.SD) #electronic engineering #information engineering
  7. ELRT: Efficient Low-Rank Training for Compact Convolutional Neural Networks
    2024/01/18 by Sui, Yang, Yin, Miao, Gong, Yu +3 · 2 citations
    #Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
  8. Robust Deep Learning Framework For Predicting Respiratory Anomalies and\n Diseases
    2020/01/21 by Lam Pham, Pham, Lam, Ian McLoughlin +9 · 1 citation
    Medicine · Computer Science · #Phonocardiography and Auscultation Techniques #Respiratory and Cough-Related Research #Music and Audio Processing
  9. Data-Centric Human Preference with Rationales for Direct Preference Alignment
    2024/07/19 by Hoang Anh Just, Ming Jin, Just, Hoang Anh +7 · 2 citations
    Decision Sciences · Computer Science · #Multi-Criteria Decision Making #Data Management and Algorithms
  10. A General Network Architecture for Sound Event Localization and Detection Using Transfer Learning and Recurrent Neural Network
    2020/11/16 by Thi Ngoc Tho Nguyen, Ngoc Khanh Nguyen, Nguyen, Thi Ngoc Tho +11 · 1 citation
    Computer Science · Biochemistry, Genetics and Molecular Biology · #Music and Audio Processing #Speech and Audio Processing #Animal Vocal Communication and Behavior
  11. Learning from Taxonomy: Multi-label Few-Shot Classification for Everyday Sound Recognition
    2022/12/17 by Jinhua Liang, Huy P. Phan, Liang, Jinhua +3 · 1 citation
    Computer Science · Engineering · #Music and Audio Processing #Speech and Audio Processing #Water Systems and Optimization
  12. Generative Audio Language Modeling with Continuous-valued Tokens and Masked Next-Token Prediction
    2025/07/14 by Yang, Shu-wen, Kim, Byeonggeun, Huang, Kuan-Po +8 · 4 citations
    #Audio and Speech Processing (eess.AS) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
  13. CoRe-Sleep: A Multimodal Fusion Framework for Time Series Robust to Imperfect Modalities
    2023/03/27 by Kontras, Konstantinos, Chatzichristos, Christos, Phan, Huy +2 · 1 citation
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Signal Processing (eess.SP) #electronic engineering #information engineering
  14. cross-modal fusion techniques for utterance-level emotion recognition from text and speech
    2023/02/05 by Jiachen Luo, Huy P. Phan, Luo, Jiachen +3 · 1 citation
    Computer Science · Psychology · #Audio and Speech Processing (eess.AS) #Emotion and Mood Recognition #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  15. From Aesthetics to Human Preferences: Comparative Perspectives of Evaluating Text-to-Music Systems
    2025/04/30 by Zhang, Huan, Liang, Jinhua, Phan, Huy +2 · 2 citations
    #Audio and Speech Processing (eess.AS) #FOS: Electrical engineering #electronic engineering #information engineering
  16. DisDet: Exploring Detectability of Backdoor Attack on Diffusion Models
    2024/02/05 by Sui, Yang, Phan, Huy, Xiao, Jinqi +6 · 1 citation
    #Computer Vision and Pattern Recognition (cs.CV) #Cryptography and Security (cs.CR) #FOS: Computer and information sciences #Machine Learning (cs.LG)
  17. Mind the Domain Gap: a Systematic Analysis on Bioacoustic Sound Event Detection
    2024/03/27 by Liang, Jinhua, Nolasco, Ines, Ghani, Burooj +3 · 1 citation
    #Audio and Speech Processing (eess.AS) #FOS: Electrical engineering #electronic engineering #information engineering
  18. 1st Place Solution to Odyssey Emotion Recognition Challenge Task1: Tackling Class Imbalance Problem
    2024/05/30 by Chen, Mingjie, Zhang, Hezhao, Li, Yuanchao +11 · 1 citation
    #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
  19. IMPACT: Iterative Mask-based Parallel Decoding for Text-to-Audio Generation with Diffusion Modeling
    2025/05/31 by Kuan-Po Huang, Huang, Kuan-Po, Shu-Wen Yang +19 · 2 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Music Technology and Sound Studies #Music and Audio Processing #Sound (cs.SD) #Speech and Audio Processing #electronic engineering #information engineering
  20. LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging
    2025/01/07 by Shubhr Singh, Emmanouil Benetos, Singh, Shubhr +5 · 1 citation
    Computer Science · #Artificial Intelligence (cs.AI) #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Neural Networks and Applications #Sound (cs.SD) #Speech Recognition and Synthesis #electronic engineering #information engineering