vix.ing · top · new · best · stats · spec

Mustikovela, Siva Karthik

  1. ViP-LLaVA: Making Large Multimodal Models Understand Arbitrary Visual Prompts
    2023/12/01 by Mu Cai, Cai, Mu, Haotian Liu +11 · 37 citations
    Computer Science · #Multimodal Machine Learning Applications #Domain Adaptation and Few-Shot Learning #Advanced Image and Video Retrieval Techniques
  2. VLM-AD: End-to-End Autonomous Driving through Vision-Language Model Supervision
    2024/12/19 by Yi Xu, Xu, Yi, Yuxin Hu +13 · 27 citations
    Computer Science · #Multimodal Machine Learning Applications
  3. Augmented Reality Meets Computer Vision : Efficient Data Generation for Urban Driving Scenes
    2017/08/04 by Alhaija, Hassan Abu, Mustikovela, Siva Karthik, Mescheder, Lars +2 · 5 citations
    #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
  4. VLMine: Long-Tail Data Mining with Vision Language Models
    2024/09/23 by Ye, Mao, Meyer, Gregory P., Zhang, Zaiwei +4 · 3 citations
    #Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
  5. Geometric Image Synthesis
    2018/09/12 by Hassan Abu Alhaija, Siva Karthik Mustikovela, Alhaija, Hassan Abu +5 · 1 citation
    Computer Science · #Advanced Vision and Imaging #Computer Graphics and Visualization Techniques #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Generative Adversarial Networks and Image Synthesis
  6. Can Ground Truth Label Propagation from Video help Semantic\n Segmentation?
    2016/10/03 by Siva Karthik Mustikovela, Michael Ying Yang, Mustikovela, Siva Karthik +3 · 1 citation
    Computer Science · #Advanced Neural Network Applications #Domain Adaptation and Few-Shot Learning #Multimodal Machine Learning Applications