Wang, Weiqing
- Sortformer: A Novel Approach for Permutation-Resolved Speaker Supervision in Speech-to-Text Systems
2024/09/10 by Park, Taejin, Medennikov, Ivan, Dhawan, Kunal +6 · 10 citations
#Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Sound (cs.SD) #electronic engineering #information engineering
- Waveform Boundary Detection for Partially Spoofed Audio
2022/11/01 by Cai, Zexin, Wang, Weiqing, Li, Ming · 4 citations
#Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Signal Processing (eess.SP) #Sound (cs.SD) #electronic engineering #information engineering
- Agent-OM: Leveraging LLM Agents for Ontology Matching
2023/12/01 by Qiang, Zhangcheng, Wang, Weiqing, Taylor, Kerry · 5 citations
#Artificial Intelligence (cs.AI) #Computation and Language (cs.CL) #FOS: Computer and information sciences #Information Retrieval (cs.IR)
- HYDRA: A Hyper Agent for Dynamic Compositional Visual Reasoning
2024/03/19 by Fucai Ke, Ke, Fucai, Zhixi Cai +9 · 5 citations
Computer Science · #Semantic Web and Ontologies #AI-based Problem Solving and Planning #Multimodal Machine Learning Applications
- Cross-Channel Attention-Based Target Speaker Voice Activity Detection: Experimental Results for M2MeT Challenge
2022/02/06 by Weiqing Wang, Xiaoyi Qin, Wang, Weiqing +3 · 2 citations
Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
- On Robustness of Prompt-based Semantic Parsing with Large Pre-trained Language Model: An Empirical Study on Codex
2023/01/30 by Zhuo, Terry Yue, Li, Zhuang, Huang, Yujin +4 · 2 citations
#Computation and Language (cs.CL) #FOS: Computer and information sciences
- Target-Speaker Voice Activity Detection via Sequence-to-Sequence Prediction
2022/10/28 by Cheng, Ming, Wang, Weiqing, Zhang, Yucong +2 · 2 citations
#Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
- An iterative framework for self-supervised deep speaker representation learning
2020/10/25 by Cai, Danwei, Wang, Weiqing, Li, Ming · 1 citation
#Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
- META-CAT: Speaker-Informed Speech Embeddings via Meta Information Concatenation for Multi-talker ASR
2024/09/18 by Jinhan Wang, Weiqing Wang, Wang, Jinhan +17 · 2 citations
Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #Speech and dialogue systems #electronic engineering #information engineering
- MMKGR: Multi-hop Multi-modal Knowledge Graph Reasoning
2022/09/03 by Zheng, Shangfei, Wang, Weiqing, Qu, Jianfeng +3 · 1 citation
#Artificial Intelligence (cs.AI) #Databases (cs.DB) #FOS: Computer and information sciences
- The DKU-DukeECE-Lenovo System for the Diarization Task of the 2021 VoxCeleb Speaker Recognition Challenge
2021/09/05 by Weiqing Wang, Danwei Cai, Wang, Weiqing +11 · 1 citation
Computer Science · #Speech Recognition and Synthesis #Speech and Audio Processing #Music and Audio Processing
- Explain Before You Answer: A Survey on Compositional Visual Reasoning
2025/08/24 by Ke, Fucai, Hsu, Joy, Cai, Zhixi +10 · 6 citations
#Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
- The DKU-DukeECE Systems for VoxCeleb Speaker Recognition Challenge 2020
2020/10/24 by Wang, Weiqing, Cai, Danwei, Qin, Xiaoyi +1 · 1 citation
#Audio and Speech Processing (eess.AS) #FOS: Electrical engineering #electronic engineering #information engineering
- The DKU-DUKEECE System for the Manipulation Region Location Task of ADD 2023
2023/08/20 by Zexin Cai, Cai, Zexin, Weiqing Wang +5 · 1 citation
Computer Science · #Artificial Intelligence (cs.AI) #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
- Privacy Risks of LLM-Empowered Recommender Systems: An Inversion Attack Perspective
2025/07/20 by Wang, Yubo, Tang, Min, Shen, Nuo +2 · 2 citations
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Information Retrieval (cs.IR)
- The DKU-DukeECE Diarization System for the VoxCeleb Speaker Recognition Challenge 2022
2022/10/04 by Wang, Weiqing, Qin, Xiaoyi, Cheng, Ming +3 · 1 citation
#Audio and Speech Processing (eess.AS) #FOS: Electrical engineering #electronic engineering #information engineering
- The DKU-MSXF Diarization System for the VoxCeleb Speaker Recognition Challenge 2023
2023/08/15 by Cheng, Ming, Wang, Weiqing, Qin, Xiaoyi +4 · 1 citation
#Audio and Speech Processing (eess.AS) #FOS: Electrical engineering #electronic engineering #information engineering
- NEST: Self-supervised Fast Conformer as All-purpose Seasoning to Speech Processing Tasks
2024/08/23 by Huang, He, Park, Taejin, Dhawan, Kunal +6 · 1 citation
#Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
- Resource-Efficient Adaptation of Speech Foundation Models for Multi-Speaker ASR
2024/09/02 by Wang, Weiqing, Dhawan, Kunal, Park, Taejin +6 · 1 citation
#Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
- How Does A Text Preprocessing Pipeline Affect Ontology Matching?
2024/11/06 by Zhangcheng Qiang, Kerry Taylor, Qiang, Zhangcheng +3 · 1 citation
Computer Science · #Natural Language Processing Techniques #Semantic Web and Ontologies #Topic Modeling
- SPGISpeech 2.0: Transcribed multi-speaker financial audio for speaker-tagged transcription
2025/08/07 by Grossman, Raymond, Park, Taejin, Dhawan, Kunal +6 · 1 citation
#Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
- MoTime: A Dataset Suite for Multimodal Time Series Forecasting
2025/05/21 by Zhou, Xin, Wang, Weiqing, Baldán, Francisco J. +2 · 2 citations
#Computation and Language (cs.CL) #Databases (cs.DB) #FOS: Computer and information sciences #Information Retrieval (cs.IR) #Machine Learning (cs.LG)
- Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering
2025/07/24 by Ivan Medennikov, Tae‐Jin Park, Medennikov, Ivan +13 · 3 citations
Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
- DWIM: Towards Tool-aware Visual Reasoning via Discrepancy-aware Workflow Generation & Instruct-Masking Tuning
2025/03/25 by Ke, Fucai, G, Vijay Kumar B, Leng, Xingjian +6 · 2 citations
#Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
- Unveiling the Potential of Text in High-Dimensional Time Series Forecasting
2025/01/13 by Zhou, Xin, Wang, Weiqing, Qu, Shilin +2 · 1 citation
#Artificial Intelligence (cs.AI) #FOS: Computer and information sciences