Chiori Hori
- Interactive Planning Using Large Language Models for Partially Observable Robotics Tasks
2023/12/11 by Lingfeng Sun, Devesh K. Jha, Sun, Lingfeng +13 · 16 citations
Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Multimodal Machine Learning Applications #Natural Language Processing Techniques #Robotics (cs.RO) #Topic Modeling
- (2.5+1)D Spatio-Temporal Scene Graphs for Video Question Answering
2022/02/18 by Anoop Cherian, Cherian, Anoop, Chiori Hori +5 · 4 citations
Computer Science · #Multimodal Machine Learning Applications #Human Pose and Action Recognition #Advanced Image and Video Retrieval Techniques
- Scenario-Aware Audio-Visual TF-GridNet for Target Speech Extraction
2023/10/30 by Zexu Pan, Pan, Zexu, Gordon Wichern +11 · 6 citations
Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Multimedia (cs.MM) #Music and Audio Processing #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
- Generation or Replication: Auscultating Audio Latent Diffusion Models
2023/10/16 by Dimitrios Bralios, Bralios, Dimitrios, Gordon Wichern +11 · 4 citations
Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
- End-to-end Conversation Modeling Track in DSTC6
2017/06/22 by Chiori Hori, Hori, Chiori, Takaaki Hori +1 · 3 citations
Computer Science · Social Sciences · #Topic Modeling #Multi-Agent Systems and Negotiation #Access Control and Trust
- End-to-End Audio Visual Scene-Aware Dialog using Multimodal Attention-Based Video Features
2018/06/21 by Chiori Hori, Hori, Chiori, Huda Alamri +23 · 4 citations
Computer Science · #Multimodal Machine Learning Applications #Human Pose and Action Recognition #Video Analysis and Summarization
- Style-transfer based Speech and Audio-visual Scene Understanding for Robot Action Sequence Acquisition from Videos
2023/06/27 by Chiori Hori, Hori, Chiori, Puyuan Peng +17 · 2 citations
Computer Science · Arts and Humanities · #Multimodal Machine Learning Applications #Human Pose and Action Recognition #Subtitles and Audiovisual Media
- Multi-Layer Content Interaction Through Quaternion Product For Visual Question Answering
2020/01/03 by Lei Shi, Shi, Lei, Shijie Geng +11 · 2 citations
Computer Science · #Multimodal Machine Learning Applications #Advanced Image and Video Retrieval Techniques #Human Pose and Action Recognition