Bin Lin
- Video-LLaVA: Learning United Visual Representation by Alignment Before Projection
2023/11/16 by Bin Lin, Yang Ye, Lin, Bin +13 · 1 voice · 281 citations
Computer Science · #cs.CV
- ShareGPT4Video: Improving Video Understanding and Generation with Better Captions
2024/06/06 by Lin Chen, Chen, Lin, Xilin Wei +27 · 88 citations
Arts and Humanities · Computer Science · #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Multimodal Machine Learning Applications #Subtitles and Audiovisual Media #Video Analysis and Summarization
- LanguageBind: Extending Video-Language Pretraining to N-modality by Language-based Semantic Alignment
2023/10/03 by Bin Zhu, Zhu, Bin, Bin Lin +23 · 59 citations
Computer Science · Biochemistry, Genetics and Molecular Biology · #Multimodal Machine Learning Applications #Video Analysis and Summarization #Cancer-related molecular mechanisms research
- MoE-LLaVA: Mixture of Experts for Large Vision-Language Models
2024/01/29 by Bin Lin, Zhenyu Tang, Lin, Bin +13 · 49 citations
Computer Science · #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Multimodal Machine Learning Applications #Natural Language Processing Techniques #Topic Modeling
- Open-Sora Plan: Open-Source Large Video Generation Model
2024/11/28 by Bin Lin, Yunyang Ge, Lin, Bin +44 · 61 citations
Mathematics · Computer Science · #Mathematical Biology Tumor Growth #Distributed and Parallel Computing Systems #Video Analysis and Summarization
- ImgEdit: A Unified Image Editing Dataset and Benchmark
2025/05/26 by Ye Yang, Xiaosong He, Ye, Yang +13 · 68 citations
Biochemistry, Genetics and Molecular Biology · Computer Science · #AI in cancer detection #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences #Image Retrieval and Classification Techniques #Single-cell and spatial transcriptomics
- Video-Bench: A Comprehensive Benchmark and Toolkit for Evaluating Video-based Large Language Models
2023/11/27 by Munan Ning, Ning, Munan, Bin Zhu +13 · 14 citations
Computer Science · #Multimodal Machine Learning Applications #Topic Modeling #Domain Adaptation and Few-Shot Learning
- Infinite-LLM: Efficient LLM Service for Long Context with DistAttention and Distributed KVCache
2024/01/05 by Bin Lin, Chen Zhang, Lin, Bin +24 · 14 citations
Computer Science · #Distributed #FOS: Computer and information sciences #Hardware Architecture (cs.AR) #Natural Language Processing Techniques #Parallel #Topic Modeling #and Cluster Computing (cs.DC)
- UNIAA: A Unified Multi-modal Image Aesthetic Assessment Baseline and Benchmark
2024/04/15 by Zhaokun Zhou, Qiulin Wang, Zhou, Zhaokun +17 · 11 citations
Neuroscience · #Aesthetic Perception and Analysis
- Advancing Code Coverage: Incorporating Program Analysis with Large Language Models
2024/04/07 by Yang Chen, Junjie Chen, Yang, Chen +7 · 10 citations
Computer Science · Engineering · #VLSI and Analog Circuit Testing #Software Testing and Debugging Techniques #Advancements in Photolithography Techniques
- Cycle3D: High-quality and Consistent Image-to-3D Generation via Generation-Reconstruction Cycle
2024/07/28 by Zhenyu Tang, Junwu Zhang, Tang, Zhenyu +13 · 9 citations
Computer Science · #Advanced Vision and Imaging #Augmented Reality Applications #Computer Graphics and Visualization Techniques #Computer Vision and Pattern Recognition (cs.CV) #FOS: Computer and information sciences
- Toward an Automated Auction Framework for Wireless Federated Learning Services Market
2019/12/13 by Yutao Jiao, Jiao, Yutao, Ping Wang +7 · 3 citations
Computer Science · #Privacy-Preserving Technologies in Data #Mobile Crowdsensing and Crowdsourcing #Blockchain Technology Applications and Security
- Sheets of human retinal progenitor transplants improve vision in rats with severe retinal degeneration
2018/05/18 by Bin Lin, Bryce T. McLelland, Anuradha Mathur +2 · 26 citations
Biochemistry, Genetics and Molecular Biology · Medicine · #Retinal Development and Disorders #Retinal and Optic Conditions #Retinal Diseases and Treatments
- Next Patch Prediction for Autoregressive Visual Generation
2024/12/19 by Pang, Yatian, Jin, Peng, Shuo Yang +17 · 7 citations
Computer Science · #Image Retrieval and Classification Techniques #Advanced Image and Video Retrieval Techniques #Advanced Vision and Imaging
- WF-VAE: Enhancing Video VAE by Wavelet-Driven Energy Flow for Latent Video Diffusion Model
2024/11/26 by Zongjian Li, Bin Lin, Li, Zongjian +11 · 5 citations
Computer Science · #Generative Adversarial Networks and Image Synthesis
- OD-VAE: An Omni-dimensional Video Compressor for Improving Latent Video Diffusion Model
2024/09/02 by Liuhan Chen, Chen, Liuhan, Zongjian Li +15 · 4 citations
Computer Science · #Video Coding and Compression Technologies #Video Analysis and Summarization #Generative Adversarial Networks and Image Synthesis
- Uniworld-V2: Reinforce Image Editing with Diffusion Negative-aware Finetuning and MLLM Implicit Feedback
2025/10/19 by Zongjian Li, Li, Zongjian, Zheyuan Liu +23 · 10 citations
Computer Science · Biochemistry, Genetics and Molecular Biology · #Generative Adversarial Networks and Image Synthesis #Cell Image Analysis Techniques #Multimodal Machine Learning Applications
- Ultrasound features of traumatic digital nerve injuries of the hand with surgical confirmation
2021/02/04 by Yoshimi Endo, Thiru Sivakumaran, Susan C. Lee +3 · 1 citation
Medicine · Neuroscience · #Nerve Injury and Rehabilitation #Nerve injury and regeneration #Peripheral Nerve Disorders
- Opinion Mining for Software Development: A Systematic Literature Review
2022/03/07 by Bin Lin, Nathan Cassee, Alexander Serebrenik +3 · 1 citation
- Takin-ADA: Emotion Controllable Audio-Driven Animation with Canonical and Landmark Loss Optimization
2024/10/18 by Bin Lin, Yanzhen Yu, Lin, Bin +12 · 1 citation
Computer Science · #Music Technology and Sound Studies #Advanced Vision and Imaging #Music and Audio Processing
- Twins: Learn to Predict Unified Representations with Focal Loss
2026/07/24 by Kaixiong Gong, Xin Cai, Bin Lin +9
#cs.CV
- Towards Dual-Brain Minimal Sufficient Representation for Vision-Language Navigation
2026/07/25 by Yihao Wu, Chenyi Xu, Liqi Yan +6
#cs.CV
- Farm Size, Technical Efficiency, and Environmental Performance: Evidence From Rice Production in China
2026/07/30 by Bin Lin, Xiaoxi Wang, Bernhard Dalheimer +1