Phan, Huy
- CHIP: CHannel Independence-based Pruning for Compact Neural Networks
2021/10/26 by Sui, Yang, Yin, Miao, Xie, Yi +3 · 5 citations
#Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Machine Learning (cs.LG)
- L-SeqSleepNet: Whole-cycle Long Sequence Modelling for Automatic Sleep Staging
2023/01/09 by Phan, Huy, Lorenzen, Kristian P., Heremans, Elisabeth +7 · 3 citations
#FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Signal Processing (eess.SP) #electronic engineering #information engineering
- Adapting Language-Audio Models as Few-Shot Audio Learners
2023/05/28 by Jinhua Liang, Xubo Liu, Liang, Jinhua +11 · 3 citations
Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
- WavCraft: Audio Editing and Generation with Large Language Models
2024/03/14 by Jinhua Liang, Liang, Jinhua, Huan Zhang +17 · 4 citations
Computer Science · #Music and Audio Processing #Speech Recognition and Synthesis
- Robust Audio Event Recognition with 1-Max Pooling Convolutional Neural\n Networks
2016/04/21 by Huy P. Phan, Lars Hertel, Phan, Huy +5 · 1 citation
Computer Science · #FOS: Computer and information sciences #Machine Learning (cs.LG) #Music and Audio Processing #Neural and Evolutionary Computing (cs.NE) #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing
- ATGNN: Audio Tagging Graph Neural Network
2023/11/02 by Singh, Shubhr, Steinmetz, Christian J., Benetos, Emmanouil +2 · 2 citations
#Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Sound (cs.SD) #electronic engineering #information engineering
- ELRT: Efficient Low-Rank Training for Compact Convolutional Neural Networks
2024/01/18 by Sui, Yang, Yin, Miao, Gong, Yu +3 · 2 citations
#Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
- Robust Deep Learning Framework For Predicting Respiratory Anomalies and\n Diseases
2020/01/21 by Lam Pham, Pham, Lam, Ian McLoughlin +9 · 1 citation
Medicine · Computer Science · #Phonocardiography and Auscultation Techniques #Respiratory and Cough-Related Research #Music and Audio Processing
- Data-Centric Human Preference with Rationales for Direct Preference Alignment
2024/07/19 by Hoang Anh Just, Ming Jin, Just, Hoang Anh +7 · 2 citations
Decision Sciences · Computer Science · #Multi-Criteria Decision Making #Data Management and Algorithms
- A General Network Architecture for Sound Event Localization and Detection Using Transfer Learning and Recurrent Neural Network
2020/11/16 by Thi Ngoc Tho Nguyen, Ngoc Khanh Nguyen, Nguyen, Thi Ngoc Tho +11 · 1 citation
Computer Science · Biochemistry, Genetics and Molecular Biology · #Music and Audio Processing #Speech and Audio Processing #Animal Vocal Communication and Behavior
- Learning from Taxonomy: Multi-label Few-Shot Classification for Everyday Sound Recognition
2022/12/17 by Jinhua Liang, Huy P. Phan, Liang, Jinhua +3 · 1 citation
Computer Science · Engineering · #Music and Audio Processing #Speech and Audio Processing #Water Systems and Optimization
- Generative Audio Language Modeling with Continuous-valued Tokens and Masked Next-Token Prediction
2025/07/14 by Yang, Shu-wen, Kim, Byeonggeun, Huang, Kuan-Po +8 · 4 citations
#Audio and Speech Processing (eess.AS) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
- CoRe-Sleep: A Multimodal Fusion Framework for Time Series Robust to Imperfect Modalities
2023/03/27 by Kontras, Konstantinos, Chatzichristos, Christos, Phan, Huy +2 · 1 citation
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Signal Processing (eess.SP) #electronic engineering #information engineering
- cross-modal fusion techniques for utterance-level emotion recognition from text and speech
2023/02/05 by Jiachen Luo, Huy P. Phan, Luo, Jiachen +3 · 1 citation
Computer Science · Psychology · #Audio and Speech Processing (eess.AS) #Emotion and Mood Recognition #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
- From Aesthetics to Human Preferences: Comparative Perspectives of Evaluating Text-to-Music Systems
2025/04/30 by Zhang, Huan, Liang, Jinhua, Phan, Huy +2 · 2 citations
#Audio and Speech Processing (eess.AS) #FOS: Electrical engineering #electronic engineering #information engineering
- DisDet: Exploring Detectability of Backdoor Attack on Diffusion Models
2024/02/05 by Sui, Yang, Phan, Huy, Xiao, Jinqi +6 · 1 citation
#Computer Vision and Pattern Recognition (cs.CV) #Cryptography and Security (cs.CR) #FOS: Computer and information sciences #Machine Learning (cs.LG)
- Mind the Domain Gap: a Systematic Analysis on Bioacoustic Sound Event Detection
2024/03/27 by Liang, Jinhua, Nolasco, Ines, Ghani, Burooj +3 · 1 citation
#Audio and Speech Processing (eess.AS) #FOS: Electrical engineering #electronic engineering #information engineering
- 1st Place Solution to Odyssey Emotion Recognition Challenge Task1: Tackling Class Imbalance Problem
2024/05/30 by Chen, Mingjie, Zhang, Hezhao, Li, Yuanchao +11 · 1 citation
#Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
- IMPACT: Iterative Mask-based Parallel Decoding for Text-to-Audio Generation with Diffusion Modeling
2025/05/31 by Kuan-Po Huang, Huang, Kuan-Po, Shu-Wen Yang +19 · 2 citations
Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Music Technology and Sound Studies #Music and Audio Processing #Sound (cs.SD) #Speech and Audio Processing #electronic engineering #information engineering
- LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging
2025/01/07 by Shubhr Singh, Emmanouil Benetos, Singh, Shubhr +5 · 1 citation
Computer Science · #Artificial Intelligence (cs.AI) #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Neural Networks and Applications #Sound (cs.SD) #Speech Recognition and Synthesis #electronic engineering #information engineering