← Open Source
OpenGVLab

VisionLLM

VisionLLM Series

ModelsVision modelsPython
Open on GitHub
Momentum
+0stars in 24 hours0.0%
1.15k
Stars
64
Forks
+0
This week
3
Contributors
Created 2023-05-18 · Updated 2026-09-27 · #9546 today
Top developers
README

VisionLLM Series

  • VisionLLM: Large Language Model as Open-Ended Decoder for Vision-Centric Tasks (NIPS2023)
  • VisionLLM v2: A Generalist Multimodal Large Language Model for Hundeds of Vision-Language Tasks (NIPS2024)

🚀 News

  • 2024/06: We release VisionLLM v2, which is a generalist multimodal large language model to support hundres of vision-language tasks, covering visual understanding, perception and generation.