vix.ing · top · new · best · stats · spec

Hori, Chiori

  1. Audio-Visual Scene-Aware Dialog
    2019/01/25 by Alamri, Huda, Cartillier, Vincent, Das, Abhishek +9 · 9 citations
    #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
  2. Attention-Based Multimodal Fusion for Video Description
    2017/01/11 by Hori, Chiori, Hori, Takaaki, Lee, Teng-Yok +3 · 7 citations
    #Computation and Language (cs.CL) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Multimedia (cs.MM)
  3. Interactive Planning Using Large Language Models for Partially Observable Robotics Tasks
    2023/12/11 by Lingfeng Sun, Sun, Lingfeng, Devesh K. Jha +13 · 12 citations
    Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Multimodal Machine Learning Applications #Natural Language Processing Techniques #Robotics (cs.RO) #Topic Modeling
  4. NIIRF: Neural IIR Filter Field for HRTF Upsampling and Personalization
    2024/02/27 by Masuyama, Yoshiki, Wichern, Gordon, Germain, François G. +4 · 8 citations
    #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
  5. (2.5+1)D Spatio-Temporal Scene Graphs for Video Question Answering
    2022/02/18 by Anoop Cherian, Chiori Hori, Cherian, Anoop +5 · 3 citations
    Computer Science · #Multimodal Machine Learning Applications #Human Pose and Action Recognition #Advanced Image and Video Retrieval Techniques
  6. Generation or Replication: Auscultating Audio Latent Diffusion Models
    2023/10/16 by Dimitrios Bralios, Gordon Wichern, Bralios, Dimitrios +11 · 4 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  7. Scenario-Aware Audio-Visual TF-GridNet for Target Speech Extraction
    2023/10/30 by Pan, Zexu, Wichern, Gordon, Masuyama, Yoshiki +4 · 2 citations
    #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Multimedia (cs.MM) #electronic engineering #information engineering
  8. Audio Visual Scene-Aware Dialog (AVSD) Challenge at DSTC7
    2018/06/01 by Alamri, Huda, Cartillier, Vincent, Lopes, Raphael Gontijo +8 · 1 citation
    #Computation and Language (cs.CL) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
  9. End-to-end Conversation Modeling Track in DSTC6
    2017/06/22 by Chiori Hori, Takaaki Hori, Hori, Chiori +1 · 2 citations
    Computer Science · Social Sciences · #Topic Modeling #Multi-Agent Systems and Negotiation #Access Control and Trust
  10. Spatio-Temporal Ranked-Attention Networks for Video Captioning
    2020/01/17 by Cherian, Anoop, Wang, Jue, Hori, Chiori +1 · 1 citation
    #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
  11. Advanced Long-context End-to-end Speech Recognition Using Context-expanded Transformers
    2021/04/19 by Hori, Takaaki, Moritz, Niko, Hori, Chiori +1 · 1 citation
    #Computation and Language (cs.CL) #FOS: Computer and information sciences
  12. Style-transfer based Speech and Audio-visual Scene Understanding for Robot Action Sequence Acquisition from Videos
    2023/06/27 by Chiori Hori, Hori, Chiori, Puyuan Peng +17 · 2 citations
    Computer Science · Arts and Humanities · #Multimodal Machine Learning Applications #Human Pose and Action Recognition #Subtitles and Audiovisual Media
  13. End-to-End Audio Visual Scene-Aware Dialog using Multimodal Attention-Based Video Features
    2018/06/21 by Chiori Hori, Hori, Chiori, Huda Alamri +23 · 1 citation
    Computer Science · #Multimodal Machine Learning Applications #Human Pose and Action Recognition #Video Analysis and Summarization
  14. Multi-Layer Content Interaction Through Quaternion Product For Visual Question Answering
    2020/01/03 by Lei Shi, Shi, Lei, Shijie Geng +11 · 1 citation
    Computer Science · #Multimodal Machine Learning Applications #Advanced Image and Video Retrieval Techniques #Human Pose and Action Recognition