Harada, Noboru
- BYOL for Audio: Self-Supervised Learning for General-Purpose Audio Representation
2021/03/11 by Niizumi, Daisuke, Takeuchi, Daiki, Ohishi, Yasunori +2 · 16 citations
#68T07 #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Sound (cs.SD) #electronic engineering #information engineering
- Description and Discussion on DCASE2020 Challenge Task2: Unsupervised Anomalous Sound Detection for Machine Condition Monitoring
2020/06/10 by Yuma Koizumi, Koizumi, Yuma, Yohei Kawaguchi +19 · 13 citations
Computer Science · Engineering · #Anomaly Detection Techniques and Applications #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Music and Audio Processing #Sound (cs.SD) #Water Systems and Optimization #electronic engineering #information engineering
- ToyADMOS: A Dataset of Miniature-Machine Operating Sounds for Anomalous Sound Detection
2019/08/09 by Yuma Koizumi, Shoichiro Saito, Koizumi, Yuma +7 · 9 citations
Computer Science · #Anomaly Detection Techniques and Applications #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Music and Audio Processing #Sound (cs.SD) #Speech and Audio Processing #electronic engineering #information engineering
- First Order Ambisonics Domain Spatial Augmentation for DNN-based Direction of Arrival Estimation
2019/10/10 by Luca Mazzon, Yuma Koizumi, Mazzon, Luca +5 · 7 citations
Computer Science · Earth and Planetary Sciences · Engineering · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Gait Recognition and Analysis #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Sound (cs.SD) #Speech and Audio Processing #Underwater Acoustics Research #electronic engineering #information engineering
- Masked Modeling Duo: Towards a Universal Audio Pre-training Framework
2024/04/09 by Niizumi, Daisuke, Takeuchi, Daiki, Ohishi, Yasunori +2 · 13 citations
#68T07 #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
- ToyADMOS2: Another dataset of miniature-machine operating sounds for anomalous sound detection under domain shift conditions
2021/06/04 by Noboru Harada, Harada, Noboru, Daisuke Niizumi +9 · 7 citations
Computer Science · Engineering · #Anomaly Detection Techniques and Applications #Audio and Speech Processing (eess.AS) #FOS: Electrical engineering #Music and Audio Processing #Water Systems and Optimization #electronic engineering #information engineering
- Description and Discussion on DCASE 2022 Challenge Task 2: Unsupervised Anomalous Sound Detection for Machine Condition Monitoring Applying Domain Generalization Techniques
2022/06/13 by Dohi, Kota, Imoto, Keisuke, Harada, Noboru +7 · 7 citations
#Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Sound (cs.SD) #electronic engineering #information engineering
- Description and Discussion on DCASE 2021 Challenge Task 2: Unsupervised Anomalous Sound Detection for Machine Condition Monitoring under Domain Shifted Conditions
2021/06/08 by Yohei Kawaguchi, Kawaguchi, Yohei, Keisuke Imoto +15 · 6 citations
Computer Science · Engineering · #Anomaly Detection Techniques and Applications #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Infrastructure Maintenance and Monitoring #Machine Fault Diagnosis Techniques #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Sound (cs.SD) #electronic engineering #information engineering
- First-shot anomaly sound detection for machine condition monitoring: A domain generalization baseline
2023/03/01 by Harada, Noboru, Niizumi, Daisuke, Ohishi, Yasunori +2 · 6 citations
#Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
- Description and Discussion on DCASE 2023 Challenge Task 2: First-Shot Unsupervised Anomalous Sound Detection for Machine Condition Monitoring
2023/05/13 by Kota Dohi, Keisuke Imoto, Dohi, Kota +17 · 8 citations
Computer Science · Decision Sciences · Engineering · #Anomaly Detection Techniques and Applications #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Multidisciplinary Science and Engineering Research #Sound (cs.SD) #Water Systems and Optimization #electronic engineering #information engineering
- Masked Modeling Duo: Learning Representations by Encouraging Both Networks to Model the Input
2022/10/26 by Daisuke Niizumi, Daiki Takeuchi, Niizumi, Daisuke +7 · 5 citations
Computer Science · #Music and Audio Processing #Speech and Audio Processing #Speech Recognition and Synthesis
- M2D-CLAP: Masked Modeling Duo Meets CLAP for Learning General-purpose Audio-Language Representation
2024/06/04 by Daisuke Niizumi, Daiki Takeuchi, Niizumi, Daisuke +11 · 7 citations
Computer Science · #Music and Audio Processing #Speech Recognition and Synthesis #Natural Language Processing Techniques
- Multi-view and Multi-modal Event Detection Utilizing Transformer-based Multi-sensor fusion
2022/02/18 by Yasuda, Masahiro, Ohishi, Yasunori, Saito, Shoichiro +1 · 3 citations
#Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
- Description and Discussion on DCASE 2024 Challenge Task 2: First-Shot Unsupervised Anomalous Sound Detection for Machine Condition Monitoring
2024/06/11 by Tomoya Nishida, Nishida, Tomoya, Noboru Harada +21 · 7 citations
Computer Science · Engineering · #Anomaly Detection Techniques and Applications #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Fault Diagnosis Techniques #Machine Learning (cs.LG) #Sound (cs.SD) #electronic engineering #information engineering
- Phase reconstruction based on recurrent phase unwrapping with deep neural networks
2020/02/14 by Yoshiki Masuyama, Kohei Yatabe, Masuyama, Yoshiki +7 · 2 citations
Computer Science · Engineering · #Acoustic Wave Phenomena Research #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Sound (cs.SD) #Speech and Audio Processing #electronic engineering #information engineering
- Unrestricted Global Phase Bias-Aware Single-channel Speech Enhancement with Conformer-based Metric GAN
2024/02/13 by Shiqi Zhang, Zhang, Shiqi, Zheng Qiu +7 · 3 citations
Computer Science · Psychology · #Speech and Audio Processing #Speech Recognition and Synthesis #Phonetics and Phonology Research
- Exploring Pre-trained General-purpose Audio Representations for Heart Murmur Detection
2024/04/26 by Niizumi, Daisuke, Takeuchi, Daiki, Ohishi, Yasunori +2 · 3 citations
#68T07 #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
- Baseline Systems and Evaluation Metrics for Spatial Semantic Segmentation of Sound Scenes
2025/03/28 by Binh Thien Nguyen, Masahiro Yasuda, Nguyen, Binh Thien +9 · 5 citations
Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
- Composing General Audio Representation by Fusing Multilayer Features of a Pre-trained Model
2022/05/17 by Niizumi, Daisuke, Takeuchi, Daiki, Ohishi, Yasunori +2 · 1 citation
#68T07 #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
- Audio Difference Captioning Utilizing Similarity-Discrepancy Disentanglement
2023/08/23 by Takeuchi, Daiki, Ohishi, Yasunori, Niizumi, Daisuke +2 · 1 citation
#Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Sound (cs.SD) #electronic engineering #information engineering
- Description and Discussion on DCASE 2025 Challenge Task 4: Spatial Semantic Segmentation of Sound Scenes
2025/06/12 by Yasuda, Masahiro, Nguyen, Binh Thien, Harada, Noboru +10 · 5 citations
#Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
- Guided Masked Self-Distillation Modeling for Distributed Multimedia Sensor Event Analysis
2024/04/12 by Masahiro Yasuda, Noboru Harada, Yasuda, Masahiro +9 · 1 citation
Engineering · Computer Science · #Advanced Chemical Sensor Technologies #Anomaly Detection Techniques and Applications #Energy Efficient Wireless Sensor Networks
- 6DoF SELD: Sound Event Localization and Detection Using Microphones and Motion Tracking Sensors on self-motioning human
2024/03/04 by Masahiro Yasuda, Shoichiro Saito, Yasuda, Masahiro +5 · 1 citation
Computer Science · #Anomaly Detection Techniques and Applications #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Sound (cs.SD) #Speech and Audio Processing #electronic engineering #information engineering
- Description and Discussion on DCASE 2025 Challenge Task 2: First-shot Unsupervised Anomalous Sound Detection for Machine Condition Monitoring
2025/06/11 by Nishida, Tomoya, Harada, Noboru, Niizumi, Daisuke +9 · 4 citations
#Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
- Effects of Word-frequency based Pre- and Post- Processings for Audio Captioning
2020/09/24 by Daiki Takeuchi, Yuma Koizumi, Takeuchi, Daiki +7 · 1 citation
Arts and Humanities · Computer Science · #Audio and Speech Processing (eess.AS) #Computation and Language (cs.CL) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Multimodal Machine Learning Applications #Sound (cs.SD) #Speech and dialogue systems #Subtitles and Audiovisual Media #electronic engineering #information engineering