← 开源
OpenGVLab

VisionLLM

VisionLLM Series

ModelsVision modelsPython
在 GitHub 打开
增长势头
+024 小时新增 Star0.0%
1.15k
Star
64
Fork
+0
本周
3
贡献者
创建于 2023-05-18 · 更新于 2026-09-27 · 今日第 9546 名
主要开发者
README

VisionLLM Series

  • VisionLLM: Large Language Model as Open-Ended Decoder for Vision-Centric Tasks (NIPS2023)
  • VisionLLM v2: A Generalist Multimodal Large Language Model for Hundeds of Vision-Language Tasks (NIPS2024)

🚀 News

  • 2024/06: We release VisionLLM v2, which is a generalist multimodal large language model to support hundres of vision-language tasks, covering visual understanding, perception and generation.