Mustikovela, Siva Karthik
- ViP-LLaVA: Making Large Multimodal Models Understand Arbitrary Visual Prompts
2023/12/01 by Mu Cai, Cai, Mu, Haotian Liu +11 · 37 citations
Computer Science · #Multimodal Machine Learning Applications #Domain Adaptation and Few-Shot Learning #Advanced Image and Video Retrieval Techniques
- VLM-AD: End-to-End Autonomous Driving through Vision-Language Model Supervision
2024/12/19 by Yi Xu, Xu, Yi, Yuxin Hu +13 · 27 citations
Computer Science · #Multimodal Machine Learning Applications
- Augmented Reality Meets Computer Vision : Efficient Data Generation for Urban Driving Scenes
2017/08/04 by Alhaija, Hassan Abu, Mustikovela, Siva Karthik, Mescheder, Lars +2 · 5 citations
#Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
- VLMine: Long-Tail Data Mining with Vision Language Models
2024/09/23 by Ye, Mao, Meyer, Gregory P., Zhang, Zaiwei +4 · 3 citations
#Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
- Geometric Image Synthesis
2018/09/12 by Hassan Abu Alhaija, Siva Karthik Mustikovela, Alhaija, Hassan Abu +5 · 1 citation
Computer Science · #Advanced Vision and Imaging #Computer Graphics and Visualization Techniques #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Generative Adversarial Networks and Image Synthesis
- Can Ground Truth Label Propagation from Video help Semantic\n Segmentation?
2016/10/03 by Siva Karthik Mustikovela, Michael Ying Yang, Mustikovela, Siva Karthik +3 · 1 citation
Computer Science · #Advanced Neural Network Applications #Domain Adaptation and Few-Shot Learning #Multimodal Machine Learning Applications