CogVLM2:新一代多模态模型,支持图像视频理解,中英双语,8K文本长度与高分辨率

GPT4V-level open-source multi-modal model based on Llama3-8B

Branch3Tags0

Introduction

GPT4V-level open-source multi-modal model based on Llama3-8B

Customize your domain
292.28 K150Visit GitHub