Navid Rajabi
- Towards Grounded Visual Spatial Reasoning in Multi-Modal Vision Language Models
2023/08/18 by Navid Rajabi, Rajabi, Navid, Jana Košecká +1 · 5 citations
Computer Science · #Multimodal Machine Learning Applications #Advanced Image and Video Retrieval Techniques #Natural Language Processing Techniques
- Q-GroundCAM: Quantifying Grounding in Vision Language Models via GradCAM
2024/04/29 by Navid Rajabi, Rajabi, Navid, Jana Košecká +1 · 1 citation
Computer Science · #Computation and Language (cs.CL) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Machine Learning (cs.LG) #Multimodal Machine Learning Applications #Natural Language Processing Techniques