CogVLM2:新一代多模态模型,支持图像视频理解,中英双语,8K文本长度与高分辨率

GPT4V-level open-source multi-modal model based on Llama3-8B

分支3Tags0

项目介绍

GPT4V-level open-source multi-modal model based on Llama3-8B

定制我的领域
292.28 K150访问 GitHub