vix.ing · top · new · best · stats · spec

Yongqi Wang

  1. Qwen3-Omni Technical Report
    2025/09/22 by Xu Jin, Jin Xu, Xu, Jin +78 · 1 voice · 66 citations
    Computer Science · Engineering · #Generative Adversarial Networks and Image Synthesis #Multimodal Machine Learning Applications #Speech and Audio Processing #cs.AI #cs.CL #cs.CV #eess.AS
  2. Frieren: Efficient Video-to-Audio Generation Network with Rectified Flow Matching
    2024/06/01 by Yongqi Wang, Wang, Yongqi, Wenxiang Guo +13 · 30 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #FOS: Electrical engineering #Multimedia (cs.MM) #Music Technology and Sound Studies #Music and Audio Processing #Sound (cs.SD) #Video Analysis and Summarization #electronic engineering #information engineering
  3. Connecting Multi-modal Contrastive Representations
    2023/05/22 by Zehan Wang, Wang, Zehan, Yang Zhao +19 · 10 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Audio and Speech Processing (eess.AS) #Computer Vision and Pattern Recognition (cs.CV) #Domain Adaptation and Few-Shot Learning #FOS: Computer and information sciences #FOS: Electrical engineering #Human Pose and Action Recognition #Machine Learning (cs.LG) #Multimedia (cs.MM) #Multimodal Machine Learning Applications #Sound (cs.SD) #electronic engineering #information engineering
  4. Robust Singing Voice Transcription Serves Synthesis
    2024/05/16 by Ruiqi Li, Li, Ruiqi, Yu Zhang +9 · 8 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  5. Make-A-Voice: Unified Voice Synthesis With Discrete Representation
    2023/05/30 by Rongjie Huang, Huang, Rongjie, Chunlei Zhang +17 · 6 citations
    Computer Science · #Speech Recognition and Synthesis #Music and Audio Processing #Topic Modeling
  6. Qwen3-ASR Technical Report
    2026/01/29 by Xian Shi, Xiong Wang, Zhifang Guo +10 · 1 voice · 2 citations
    #cs.CL #cs.SD #eess.AS
  7. Accompanied Singing Voice Synthesis with Fully Text-controlled Melody
    2024/07/02 by Ruiqi Li, Zhiqing Hong, Li, Ruiqi +11 · 4 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  8. Data-free Multi-label Image Recognition via LLM-powered Prompt Tuning
    2024/03/02 by Shuo Yang, Zirui Shang, Yang, Shuo +11 · 3 citations
    Computer Science · #Text and Document Classification Technologies #Handwritten Text Recognition Techniques
  9. Text-to-Song: Towards Controllable Music Generation Incorporating Vocals and Accompaniment
    2024/04/14 by Zhiqing Hong, Rongjie Huang, Hong, Zhiqing +13 · 3 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Music Technology and Sound Studies #Music and Audio Processing #electronic engineering #information engineering
  10. Speech-to-Speech Translation with Discrete-Unit-Based Style Transfer
    2023/09/14 by Yongqi Wang, Wang, Yongqi, Jionghao Bai +9 · 2 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  11. Qwen-Music Technical Report
    2026/07/27 by Jin Xu, Kangdi Wang, Ruibin Yuan +24
    #cs.SD