vix.ing · top · new · best · stats · spec

Ohishi, Yasunori

  1. BYOL for Audio: Self-Supervised Learning for General-Purpose Audio\n Representation
    2021/03/11 by Daisuke Niizumi, Daiki Takeuchi, Niizumi, Daisuke +7 · 20 citations
    Computer Science · #68T07 #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  2. ToyADMOS2: Another dataset of miniature-machine operating sounds for anomalous sound detection under domain shift conditions
    2021/06/04 by Noboru Harada, Harada, Noboru, Daisuke Niizumi +9 · 9 citations
    Computer Science · Engineering · #Anomaly Detection Techniques and Applications #Audio and Speech Processing (eess.AS) #FOS: Electrical engineering #Music and Audio Processing #Water Systems and Optimization #electronic engineering #information engineering
  3. Masked Modeling Duo: Towards a Universal Audio Pre-training Framework
    2024/04/09 by Daisuke Niizumi, Daiki Takeuchi, Niizumi, Daisuke +7 · 17 citations
    Computer Science · #68T07 #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Music Technology and Sound Studies #Sound (cs.SD) #electronic engineering #information engineering
  4. SoundBeam: Target sound extraction conditioned on sound-class labels and enrollment clues for increased performance and continuous learning
    2022/04/08 by Marc Delcroix, Jorge Bennasar Vázquez, Delcroix, Marc +9 · 9 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  5. First-shot anomaly sound detection for machine condition monitoring: A domain generalization baseline
    2023/03/01 by Noboru Harada, Harada, Noboru, Daisuke Niizumi +7 · 8 citations
    Computer Science · Engineering · #Anomaly Detection Techniques and Applications #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Sound (cs.SD) #Water Systems and Optimization #electronic engineering #information engineering
  6. Masked Modeling Duo: Learning Representations by Encouraging Both Networks to Model the Input
    2022/10/26 by Daisuke Niizumi, Daiki Takeuchi, Niizumi, Daisuke +7 · 7 citations
    Computer Science · #Music and Audio Processing #Speech and Audio Processing #Speech Recognition and Synthesis
  7. Echo-aware Adaptation of Sound Event Localization and Detection in Unknown Environments
    2022/02/18 by Masahiro Yasuda, Yasuda, Masahiro, Yasunori Ohishi +3 · 5 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  8. M2D-CLAP: Masked Modeling Duo Meets CLAP for Learning General-purpose Audio-Language Representation
    2024/06/04 by Daisuke Niizumi, Daiki Takeuchi, Niizumi, Daisuke +11 · 9 citations
    Computer Science · #Music and Audio Processing #Speech Recognition and Synthesis #Natural Language Processing Techniques
  9. Multi-view and Multi-modal Event Detection Utilizing Transformer-based Multi-sensor fusion
    2022/02/18 by Masahiro Yasuda, Yasunori Ohishi, Yasuda, Masahiro +5 · 3 citations
    Computer Science · Engineering · #Anomaly Detection Techniques and Applications #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Fire Detection and Safety Systems #Sound (cs.SD) #Video Surveillance and Tracking Methods #electronic engineering #information engineering
  10. Audio Captioning using Pre-Trained Large-Scale Language Model Guided by Audio-based Similar Caption Retrieval
    2020/12/14 by Yuma Koizumi, Yasunori Ohishi, Koizumi, Yuma +7 · 4 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Natural Language Processing Techniques #Sound (cs.SD) #Video Analysis and Summarization #electronic engineering #information engineering
  11. Exploring Pre-trained General-purpose Audio Representations for Heart Murmur Detection
    2024/04/26 by Niizumi, Daisuke, Takeuchi, Daiki, Ohishi, Yasunori +2 · 3 citations
    #68T07 #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
  12. The NTT DCASE2020 Challenge Task 6 system: Automated Audio Captioning with Keywords and Sentence Length Estimation
    2020/07/01 by Yuma Koizumi, Daiki Takeuchi, Koizumi, Yuma +7 · 2 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Music and Audio Processing #Natural Language Processing Techniques #Sound (cs.SD) #Video Analysis and Summarization #electronic engineering #information engineering
  13. Baseline Systems and Evaluation Metrics for Spatial Semantic Segmentation of Sound Scenes
    2025/03/28 by Binh Thien Nguyen, Nguyen, Binh Thien, Masahiro Yasuda +9 · 6 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  14. Composing General Audio Representation by Fusing Multilayer Features of a Pre-trained Model
    2022/05/17 by Niizumi, Daisuke, Takeuchi, Daiki, Ohishi, Yasunori +2 · 2 citations
    #68T07 #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
  15. Audio Difference Captioning Utilizing Similarity-Discrepancy Disentanglement
    2023/08/23 by Takeuchi, Daiki, Ohishi, Yasunori, Niizumi, Daisuke +2 · 1 citation
    #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Sound (cs.SD) #electronic engineering #information engineering
  16. Description and Discussion on DCASE 2025 Challenge Task 4: Spatial Semantic Segmentation of Sound Scenes
    2025/06/12 by Yasuda, Masahiro, Nguyen, Binh Thien, Harada, Noboru +10 · 5 citations
    #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
  17. Guided Masked Self-Distillation Modeling for Distributed Multimedia Sensor Event Analysis
    2024/04/12 by Masahiro Yasuda, Noboru Harada, Yasuda, Masahiro +9 · 1 citation
    Engineering · Computer Science · #Advanced Chemical Sensor Technologies #Anomaly Detection Techniques and Applications #Energy Efficient Wireless Sensor Networks
  18. Effects of Word-frequency based Pre- and Post- Processings for Audio Captioning
    2020/09/24 by Daiki Takeuchi, Takeuchi, Daiki, Yuma Koizumi +7 · 1 citation
    Arts and Humanities · Computer Science · #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Multimodal Machine Learning Applications #Sound (cs.SD) #Speech and dialogue systems #Subtitles and Audiovisual Media #electronic engineering #information engineering