VideoLLaMA3:基于Qwen2.5生态的多模态基础模型项目

Frontier Multimodal Foundation Models for Image and Video Understanding

分支1Tags0

项目介绍

面向图像与视频理解的前沿多模态基础模型【此简介由AI生成】

定制我的领域
131.17 K88访问 GitHub