vix.ing · top · new · best · stats · spec

Chiori Hori

  1. Interactive Planning Using Large Language Models for Partially Observable Robotics Tasks
    2023/12/11 by Lingfeng Sun, Devesh K. Jha, Sun, Lingfeng +13 · 16 citations
    Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Multimodal Machine Learning Applications #Natural Language Processing Techniques #Robotics (cs.RO) #Topic Modeling
  2. (2.5+1)D Spatio-Temporal Scene Graphs for Video Question Answering
    2022/02/18 by Anoop Cherian, Cherian, Anoop, Chiori Hori +5 · 4 citations
    Computer Science · #Multimodal Machine Learning Applications #Human Pose and Action Recognition #Advanced Image and Video Retrieval Techniques
  3. Scenario-Aware Audio-Visual TF-GridNet for Target Speech Extraction
    2023/10/30 by Zexu Pan, Pan, Zexu, Gordon Wichern +11 · 6 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Multimedia (cs.MM) #Music and Audio Processing #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  4. Generation or Replication: Auscultating Audio Latent Diffusion Models
    2023/10/16 by Dimitrios Bralios, Bralios, Dimitrios, Gordon Wichern +11 · 4 citations
    Computer Science · #Audio and Speech Processing (eess.AS) #FOS: Computer and information sciences #FOS: Electrical engineering #Music and Audio Processing #Sound (cs.SD) #Speech Recognition and Synthesis #Speech and Audio Processing #electronic engineering #information engineering
  5. End-to-end Conversation Modeling Track in DSTC6
    2017/06/22 by Chiori Hori, Hori, Chiori, Takaaki Hori +1 · 3 citations
    Computer Science · Social Sciences · #Topic Modeling #Multi-Agent Systems and Negotiation #Access Control and Trust
  6. End-to-End Audio Visual Scene-Aware Dialog using Multimodal Attention-Based Video Features
    2018/06/21 by Chiori Hori, Hori, Chiori, Huda Alamri +23 · 4 citations
    Computer Science · #Multimodal Machine Learning Applications #Human Pose and Action Recognition #Video Analysis and Summarization
  7. Style-transfer based Speech and Audio-visual Scene Understanding for Robot Action Sequence Acquisition from Videos
    2023/06/27 by Chiori Hori, Hori, Chiori, Puyuan Peng +17 · 2 citations
    Computer Science · Arts and Humanities · #Multimodal Machine Learning Applications #Human Pose and Action Recognition #Subtitles and Audiovisual Media
  8. Multi-Layer Content Interaction Through Quaternion Product For Visual Question Answering
    2020/01/03 by Lei Shi, Shi, Lei, Shijie Geng +11 · 2 citations
    Computer Science · #Multimodal Machine Learning Applications #Advanced Image and Video Retrieval Techniques #Human Pose and Action Recognition