vix.ing · top · new · best · stats · spec

Ling, Zhen-Hua

  1. Corrective Retrieval Augmented Generation
    2024/01/29 by Shi-Qi Yan, Yan, Shi-Qi, Jia-Chen Gu +5 · 21 citations
    Computer Science · #Computation and Language (cs.CL) #FOS: Computer and information sciences #Speech and dialogue systems
  2. Model Editing Harms General Abilities of Large Language Models: Regularization to the Rescue
    2024/01/09 by Jia-Chen Gu, Gu, Jia-Chen, Hao-Xiang Xu +11 · 18 citations
    Computer Science · #Computation and Language (cs.CL) #FOS: Computer and information sciences #Natural Language Processing Techniques #Text Readability and Simplification #Topic Modeling
  3. Towards High-Quality and Efficient Speech Bandwidth Extension with Parallel Amplitude and Phase Prediction
    2024/01/12 by Ye-Xin Lu, Yang Ai, Lu, Ye-Xin +5 · 10 citations
    Computer Science · #Speech and Audio Processing #Speech Recognition and Synthesis #Advanced Data Compression Techniques
  4. APCodec: A Neural Audio Codec with Parallel Amplitude and Phase Spectrum Encoding and Decoding
    2024/02/16 by Ai, Yang, Jiang, Xiao-Hang, Lu, Ye-Xin +2 · 10 citations
    #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
  5. APNet2: High-quality and High-efficiency Neural Vocoder with Direct Prediction of Amplitude and Phase Spectra
    2023/11/20 by Hui-Peng Du, Ye-Xin Lu, Du, Hui-Peng +5 · 8 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Electrical engineering #Natural Language Processing Techniques #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  6. Align, Mask and Select: A Simple Method for Incorporating Commonsense Knowledge into Language Representation Models
    2019/08/19 by Zhi-Xiu Ye, Ye, Zhi-Xiu, Chen Qian +5 · 8 citations
    Computer Science · #Topic Modeling #Natural Language Processing Techniques #Multimodal Machine Learning Applications
  7. Explicit Estimation of Magnitude and Phase Spectra in Parallel for High-Quality Speech Enhancement
    2023/08/17 by Ye-Xin Lu, Yang Ai, Lu, Ye-Xin +3 · 6 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  8. APNet: An All-Frame-Level Neural Vocoder Incorporating Direct Prediction of Amplitude and Phase Spectra
    2023/05/13 by Yang Ai, Zhen-Hua Ling, Ai, Yang +1 · 6 citations
    Computer Science · Psychology · #Speech Recognition and Synthesis #Speech and Audio Processing #Phonetics and Phonology Research
  9. Perturbation-Restrained Sequential Model Editing
    2024/05/27 by Jun-Yu Ma, Ma, Jun-Yu, Hong Wang +7 · 5 citations
    Computer Science · Decision Sciences · #Computation and Language (cs.CL) #FOS: Computer and information sciences #Model-Driven Software Engineering Techniques #Reinforcement Learning in Robotics #Simulation Techniques and Applications
  10. Speaker-Aware BERT for Multi-Turn Response Selection in Retrieval-Based Chatbots
    2020/04/07 by Gu, Jia-Chen, Li, Tianda, Liu, Quan +4 · 2 citations
    #Computation and Language (cs.CL) #FOS: Computer and information sciences
  11. Retrieving, Rethinking and Revising: The Chain-of-Verification Can Improve Retrieval Augmented Generation
    2024/10/08 by Bolei He, Nuo Chen, He, Bolei +11 · 5 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Natural Language Processing Techniques
  12. Clever Hans Effect Found in Automatic Detection of Alzheimer's Disease through Speech
    2024/06/11 by Liu, Yin-Long, Feng, Rui, Yuan, Jia-Hong +1 · 4 citations
    #Audio and Speech Processing (eess.AS) #FOS: Electrical engineering #electronic engineering #information engineering
  13. Asynchronous Voice Anonymization Using Adversarial Perturbation On Speaker Embedding
    2024/06/12 by Wang, Rui, Chen, Liping, Lee, Kong AiK +1 · 5 citations
    #Artificial Intelligence (cs.AI) #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
  14. MDCTCodec: A Lightweight MDCT-based Neural Audio Codec towards High Sampling Rate and Low Bitrate Scenarios
    2024/11/01 by Xiao-Hang Jiang, Yang Ai, Jiang, Xiao-Hang +9 · 7 citations
    Computer Science · #Advanced Data Compression Techniques #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #electronic engineering #information engineering
  15. BASEN: Time-Domain Brain-Assisted Speech Enhancement Network with Convolutional Cross Attention in Multi-talker Conditions
    2023/05/17 by Zhang, Jie, Xu, Qing-Tian, Zhu, Qiu-Shi +1 · 2 citations
    #Artificial Intelligence (cs.AI) #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
  16. Neural Speech Phase Prediction based on Parallel Estimation Architecture and Anti-Wrapping Losses
    2022/11/29 by Yang Ai, Zhen-Hua Ling, Ai, Yang +1 · 4 citations
    Computer Science · Psychology · #Speech and Audio Processing #Speech Recognition and Synthesis #Phonetics and Phonology Research
  17. Multi-Stage Speech Bandwidth Extension with Flexible Sampling Rate Control
    2024/06/04 by Ye-Xin Lu, Lu, Ye-Xin, Yang Ai +5 · 3 citations
    Computer Science · #Advanced Data Compression Techniques #Speech and Audio Processing #Speech Recognition and Synthesis
  18. Probabilistic Reasoning via Deep Learning: Neural Association Models
    2016/03/24 by Liu, Quan, Jiang, Hui, Evdokimov, Andrew +4 · 1 citation
    #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Neural and Evolutionary Computing (cs.NE)
  19. Voice Attribute Editing with Text Prompt
    2024/04/13 by Zhengyan Sheng, Yang Ai, Sheng, Zhengyan +7 · 3 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Natural Language Processing Techniques #Sound (cs.SD) #Speech Recognition and Synthesis #Topic Modeling #electronic engineering #information engineering
  20. Face-Driven Zero-Shot Voice Conversion with Memory-based Face-Voice Alignment
    2023/09/18 by Zheng-Yan Sheng, Yang Ai, Sheng, Zheng-Yan +5 · 2 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Face recognition and analysis #Machine Learning (cs.LG) #Multimedia (cs.MM) #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  21. Learning latent representations for style control and transfer in end-to-end speech synthesis
    2018/12/11 by Zhang, Ya-Jie, Pan, Shifeng, He, Lei +1 · 1 citation
    #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
  22. Distant Supervision Relation Extraction with Intra-Bag and Inter-Bag Attentions
    2019/03/30 by Zhi-Xiu Ye, Ye, Zhi-Xiu, Zhen-Hua Ling +1 · 1 citation
    Computer Science · #Topic Modeling #Natural Language Processing Techniques #Multimodal Machine Learning Applications
  23. Pitch-and-Spectrum-Aware Singing Quality Assessment with Bias Correction and Model Fusion
    2024/11/17 by Shi, Yu-Fei, Ai, Yang, Lu, Ye-Xin +2 · 2 citations
    #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
  24. WIDER & CLOSER: Mixture of Short-channel Distillers for Zero-shot Cross-lingual Named Entity Recognition
    2022/12/07 by Jun-Yu Ma, Beiduo Chen, Ma, Jun-Yu +13 · 1 citation
    Computer Science · #Computation and Language (cs.CL) #FOS: Computer and information sciences #Natural Language Processing Techniques #Text and Document Classification Technologies #Topic Modeling
  25. Speech Reconstruction from Silent Tongue and Lip Articulation By Pseudo Target Generation and Domain Adversarial Training
    2023/04/12 by Rui-Chen Zheng, Yang Ai, Zheng, Rui-Chen +3 · 1 citation
    Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Electrical engineering #Face recognition and analysis #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  26. Low-Latency Neural Speech Phase Prediction based on Parallel Estimation Architecture and Anti-Wrapping Losses for Speech Generation Tasks
    2024/03/26 by Ai, Yang, Ling, Zhen-Hua · 3 citations
    #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
  27. ERVQ: Enhanced Residual Vector Quantization with Intra-and-Inter-Codebook Optimization for Neural Audio Codecs
    2024/10/16 by Rui-Chen Zheng, Hui-Peng Du, Zheng, Rui-Chen +7 · 3 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Electrical engineering #Music and Audio Processing #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  28. APCodec+: A Spectrum-Coding-Based High-Fidelity and High-Compression-Rate Neural Audio Codec with Staged Training Paradigm
    2024/10/30 by Hui-Peng Du, Du, Hui-Peng, Yang Ai +5 · 2 citations
    Computer Science · #Digital Filter Design and Implementation #Advanced Data Compression Techniques #Image and Signal Denoising Methods
  29. Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?
    2025/08/11 by Hui-Peng Du, Du, Hui-Peng, Yang Ai +7 · 1 citation
    Computer Science · Psychology · #Speech Recognition and Synthesis #Speech and Audio Processing #Emotion and Mood Recognition
  30. Leveraging Prompt Learning and Pause Encoding for Alzheimer's Disease Detection
    2024/12/09 by Yin-Long Liu, Liu, Yin-Long, Rui Feng +5 · 1 citation
    Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning in Healthcare #Sound (cs.SD) #electronic engineering #information engineering
  31. Audio-Visual Representation Learning via Knowledge Distillation from Speech Foundation Models
    2025/02/09 by Jing-Xuan Zhang, Zhang, Jing-Xuan, Genshun Wan +5 · 2 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Music Technology and Sound Studies #Music and Audio Processing #Sound (cs.SD) #electronic engineering #information engineering
  32. VideoTG-R1: Boosting Video Temporal Grounding via Curriculum Reinforcement Learning on Reflected Boundary Annotations
    2025/10/27 by Dong, Lu, Zhang, Haiyu, Lin, Han +8 · 1 citation
    #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
  33. RPO: Retrieval Preference Optimization for Robust Retrieval-Augmented Generation
    2025/01/23 by Shi-Qi Yan, Yan, Shi-Qi, Liu, Quan +1 · 1 citation
    Computer Science · #Advanced Image and Video Retrieval Techniques #Computation and Language (cs.CL) #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #Machine Learning and ELM
  34. Unispeaker: A Unified Approach for Multimodality-driven Speaker Generation
    2025/01/11 by Sheng, Zhengyan, Du, Zhihao, Lu, Heng +2 · 1 citation
    #Artificial Intelligence (cs.AI) #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering