Théo Moutakanni
- DINOv2: Learning Robust Visual Features without Supervision
2023/04/14 by Maxime Oquab, Oquab, Maxime, Timothée Darcet +50 · 5 voices · 1637 citations
Computer Science · #Multimodal Machine Learning Applications #Domain Adaptation and Few-Shot Learning #Advanced Neural Network Applications
- VL-JEPA: Joint Embedding Predictive Architecture for Vision-language
2025/12/11 by Delong Chen, Chen, Delong, Mustafa Shukor +19 · 7 voices · 1 citation
Computer Science · #Multimodal Machine Learning Applications #Domain Adaptation and Few-Shot Learning #Advanced Image and Video Retrieval Techniques
- Embodied AI Agents: Modeling the World
2025/06/27 by Pascale Fung, Yoram Bachrach, Fung, Pascale +39 · 1 voice · 20 citations
Computer Science · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #cs.AI
- DINOv2 Meets Text: A Unified Framework for Image- and Pixel-Level Vision-Language Alignment
2024/12/20 by Cijo Jose, Jose, Cijo, Théo Moutakanni +25 · 25 citations
Computer Science · #Multimodal Machine Learning Applications #Advanced Image and Video Retrieval Techniques #Image Retrieval and Classification Techniques
- Automatic Data Curation for Self-Supervised Learning: A Clustering-Based Approach
2024/05/24 by Huy V. Vo, Vo, Huy V., Vasil Khalidov +23 · 1 voice · 10 citations
Computer Science · #Artificial Intelligence (cs.AI) #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Machine Learning (cs.LG) #cs.AI #cs.CV #cs.LG
- Planning with Reasoning using Vision Language World Model
2025/09/02 by Delong Chen, Chen, Delong, Théo Moutakanni +11 · 11 citations
Social Sciences · #Artificial Intelligence (cs.AI) #FOS: Computer and information sciences #Geographic Information Systems Studies