vix.ing · top · new · best · stats · spec

Takuhiro Kaneko

  1. Parallel-Data-Free Voice Conversion Using Cycle-Consistent Adversarial Networks
    2017/11/30 by Takuhiro Kaneko, Hirokazu Kameoka, Kaneko, Takuhiro +1 · 27 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (stat.ML) #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  2. iSTFTNet: Fast and Lightweight Mel-Spectrogram Vocoder Incorporating Inverse Short-Time Fourier Transform
    2022/03/04 by Takuhiro Kaneko, Kou Tanaka, Kaneko, Takuhiro +5 · 14 citations
    Computer Science · #Advanced Data Compression Techniques #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  3. CycleGAN-VC2: Improved CycleGAN-based Non-parallel Voice Conversion
    2019/04/09 by Takuhiro Kaneko, Kaneko, Takuhiro, Hirokazu Kameoka +5 · 10 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  4. StarGAN-VC2: Rethinking Conditional Methods for StarGAN-Based Voice Conversion
    2019/07/29 by Takuhiro Kaneko, Kaneko, Takuhiro, Hirokazu Kameoka +5 · 12 citations
    Computer Science · #Speech Recognition and Synthesis #Speech and Audio Processing #Music and Audio Processing
  5. Label-Noise Robust Generative Adversarial Networks
    2018/11/27 by Takuhiro Kaneko, Yoshitaka Ushiku, Kaneko, Takuhiro +3 · 5 citations
    Computer Science · Physics and Astronomy · #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Generative Adversarial Networks and Image Synthesis #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Model Reduction and Neural Networks #Music and Audio Processing
  6. ACVAE-VC: Non-parallel many-to-many voice conversion with auxiliary classifier variational autoencoder
    2018/08/13 by Hirokazu Kameoka, Kameoka, Hirokazu, Takuhiro Kaneko +5 · 6 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  7. Unsupervised Learning of Depth and Depth-of-Field Effect from Natural Images with Aperture Rendering Generative Adversarial Networks
    2021/06/24 by Takuhiro Kaneko, Kaneko, Takuhiro · 2 citations
    Computer Science · #Advanced Image Processing Techniques #Advanced Vision and Imaging #Computer Graphics and Visualization Techniques #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #FOS: Electrical engineering #Image and Video Processing (eess.IV) #Machine Learning (cs.LG) #Machine Learning (stat.ML) #electronic engineering #information engineering
  8. MaskCycleGAN-VC: Learning Non-parallel Voice Conversion with Filling in Frames
    2021/02/25 by Takuhiro Kaneko, Hirokazu Kameoka, Kaneko, Takuhiro +5 · 4 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  9. AR-NeRF: Unsupervised Learning of Depth and Defocus Effects from Natural Images with Aperture Rendering Neural Radiance Fields
    2022/06/13 by Takuhiro Kaneko, Kaneko, Takuhiro · 3 citations
    Computer Science · Engineering · #Advanced Image Processing Techniques #Advanced Vision and Imaging #Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #FOS: Electrical engineering #Graphics (cs.GR) #Image Processing Techniques and Applications #Image and Video Processing (eess.IV) #Machine Learning (cs.LG) #electronic engineering #information engineering
  10. Unsupervised Intrinsic Image Decomposition with LiDAR Intensity
    2023/03/20 by Shogo Sato, Yasuhiro Yao, Sato, Shogo +9 · 3 citations
    Computer Science · Engineering · Environmental Science · #Advanced Image Fusion Techniques #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Image Enhancement Techniques #Remote Sensing and LiDAR Applications
  11. Generative adversarial network-based approach to signal reconstruction from magnitude spectrograms
    2018/04/06 by K. Oyamada, Hirokazu Kameoka, Oyamada, Keisuke +9 · 3 citations
    Computer Science · #Blind Source Separation Techniques #FOS: Computer and information sciences #FOS: Electrical engineering #Image and Signal Denoising Methods #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Signal Processing (eess.SP) #Speech and Audio Processing #electronic engineering #information engineering
  12. WaveCycleGAN2: Time-domain Neural Post-filter for Speech Waveform Generation
    2019/04/05 by Kou Tanaka, Tanaka, Kou, Hirokazu Kameoka +5 · 2 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  13. iSTFTNet2: Faster and More Lightweight iSTFT-Based Neural Vocoder Using 1D-2D CNN
    2023/08/14 by Takuhiro Kaneko, Hirokazu Kameoka, Kaneko, Takuhiro +5 · 3 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Machine Learning (cs.LG) #Machine Learning (stat.ML) #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  14. Noise Robust Generative Adversarial Networks
    2019/11/26 by Takuhiro Kaneko, Kaneko, Takuhiro, Tatsuya Harada +1 · 1 citation
    Computer Science · #Advanced Image Processing Techniques #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #FOS: Electrical engineering #Generative Adversarial Networks and Image Synthesis #Image and Signal Denoising Methods #Image and Video Processing (eess.IV) #Machine Learning (cs.LG) #Machine Learning (stat.ML) #electronic engineering #information engineering
  15. FastS2S-VC: Streaming Non-Autoregressive Sequence-to-Sequence Voice Conversion
    2021/04/14 by Hirokazu Kameoka, Kou Tanaka, Kameoka, Hirokazu +3 · 1 citation
    Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Natural Language Processing Techniques #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  16. VoiceGrad: Non-Parallel Any-to-Many Voice Conversion with Annealed Langevin Dynamics
    2020/10/06 by Hirokazu Kameoka, Takuhiro Kaneko, Kameoka, Hirokazu +7 · 4 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering