Hori, Chiori
- Audio-Visual Scene-Aware Dialog
2019/01/25 by Alamri, Huda, Cartillier, Vincent, Das, Abhishek +9 · 9 citations
#Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
- Attention-Based Multimodal Fusion for Video Description
2017/01/11 by Hori, Chiori, Hori, Takaaki, Lee, Teng-Yok +3 · 7 citations
#Computation and Language (cs.CL) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Multimedia (cs.MM)
- Interactive Planning Using Large Language Models for Partially Observable Robotics Tasks
2023/12/11 by Lingfeng Sun, Sun, Lingfeng, Devesh K. Jha +13 · 12 citations
Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Multimodal Machine Learning Applications #Natural Language Processing Techniques #Robotics (cs.RO) #Topic Modeling
- NIIRF: Neural IIR Filter Field for HRTF Upsampling and Personalization
2024/02/27 by Masuyama, Yoshiki, Wichern, Gordon, Germain, François G. +4 · 8 citations
#Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Sound (cs.SD) #electronic engineering #information engineering
- (2.5+1)D Spatio-Temporal Scene Graphs for Video Question Answering
2022/02/18 by Anoop Cherian, Chiori Hori, Cherian, Anoop +5 · 3 citations
Computer Science · #Multimodal Machine Learning Applications #Human Pose and Action Recognition #Advanced Image and Video Retrieval Techniques
- Generation or Replication: Auscultating Audio Latent Diffusion Models
2023/10/16 by Dimitrios Bralios, Gordon Wichern, Bralios, Dimitrios +11 · 4 citations
Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
- Scenario-Aware Audio-Visual TF-GridNet for Target Speech Extraction
2023/10/30 by Pan, Zexu, Wichern, Gordon, Masuyama, Yoshiki +4 · 2 citations
#Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Multimedia (cs.MM) #electronic engineering #information engineering
- Audio Visual Scene-Aware Dialog (AVSD) Challenge at DSTC7
2018/06/01 by Alamri, Huda, Cartillier, Vincent, Lopes, Raphael Gontijo +8 · 1 citation
#Computation and Language (cs.CL) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
- End-to-end Conversation Modeling Track in DSTC6
2017/06/22 by Chiori Hori, Takaaki Hori, Hori, Chiori +1 · 2 citations
Computer Science · Social Sciences · #Topic Modeling #Multi-Agent Systems and Negotiation #Access Control and Trust
- Spatio-Temporal Ranked-Attention Networks for Video Captioning
2020/01/17 by Cherian, Anoop, Wang, Jue, Hori, Chiori +1 · 1 citation
#Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
- Advanced Long-context End-to-end Speech Recognition Using Context-expanded Transformers
2021/04/19 by Hori, Takaaki, Moritz, Niko, Hori, Chiori +1 · 1 citation
#Computation and Language (cs.CL) #FOS: Computer and information sciences
- Style-transfer based Speech and Audio-visual Scene Understanding for Robot Action Sequence Acquisition from Videos
2023/06/27 by Chiori Hori, Hori, Chiori, Puyuan Peng +17 · 2 citations
Computer Science · Arts and Humanities · #Multimodal Machine Learning Applications #Human Pose and Action Recognition #Subtitles and Audiovisual Media
- End-to-End Audio Visual Scene-Aware Dialog using Multimodal Attention-Based Video Features
2018/06/21 by Chiori Hori, Hori, Chiori, Huda Alamri +23 · 1 citation
Computer Science · #Multimodal Machine Learning Applications #Human Pose and Action Recognition #Video Analysis and Summarization
- Multi-Layer Content Interaction Through Quaternion Product For Visual Question Answering
2020/01/03 by Lei Shi, Shi, Lei, Shijie Geng +11 · 1 citation
Computer Science · #Multimodal Machine Learning Applications #Advanced Image and Video Retrieval Techniques #Human Pose and Action Recognition