vix.ing · top · new · best · stats · spec

Théo Moutakanni

  1. DINOv2: Learning Robust Visual Features without Supervision
    2023/04/14 by Maxime Oquab, Oquab, Maxime, Timothée Darcet +50 · 5 voices · 1637 citations
    Computer Science · #Multimodal Machine Learning Applications #Domain Adaptation and Few-Shot Learning #Advanced Neural Network Applications
  2. VL-JEPA: Joint Embedding Predictive Architecture for Vision-language
    2025/12/11 by Delong Chen, Chen, Delong, Mustafa Shukor +19 · 7 voices · 1 citation
    Computer Science · #Multimodal Machine Learning Applications #Domain Adaptation and Few-Shot Learning #Advanced Image and Video Retrieval Techniques
  3. Embodied AI Agents: Modeling the World
    2025/06/27 by Pascale Fung, Yoram Bachrach, Fung, Pascale +39 · 1 voice · 20 citations
    Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #cs.AI
  4. DINOv2 Meets Text: A Unified Framework for Image- and Pixel-Level Vision-Language Alignment
    2024/12/20 by Cijo Jose, Jose, Cijo, Théo Moutakanni +25 · 25 citations
    Computer Science · #Multimodal Machine Learning Applications #Advanced Image and Video Retrieval Techniques #Image Retrieval and Classification Techniques
  5. Automatic Data Curation for Self-Supervised Learning: A Clustering-Based Approach
    2024/05/24 by Huy V. Vo, Vo, Huy V., Vasil Khalidov +23 · 1 voice · 10 citations
    Computer Science · #Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Machine Learning (cs.LG) #cs.AI #cs.CV #cs.LG
  6. Planning with Reasoning using Vision Language World Model
    2025/09/02 by Delong Chen, Chen, Delong, Théo Moutakanni +11 · 11 citations
    Social Sciences · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Geographic Information Systems Studies