tencent_hunyuan

tencent_hunyuan

腾讯混元

公告
暂无公告
热门项目
136

HunyuanImage-3.0 统一多模态理解与生成,基于自回归框架,实现文本生成图像,性能媲美或超越领先闭源模型

105

Hy3 是由腾讯混元团队研发的快慢思考融合的混合专家模型,总参数量 295B,激活参数 21B,MTP 层参数 3.8B。4 月底发布 Hy3 Preview 后,我们在 50 多个业务中获得了广泛的反馈,修复了各种体验问题,进一步提升了后训练的质量和规模。今天,我们发布 Hy3。它展现出显著强于同尺寸并比肩旗舰(参数规模往往是 Hy3 的 2~5 倍)开源模型的智能水平,显著提升了在各类产品和生产力任务中的实用价值。

84

混元3D世界重建模型,支持多模态先验注入和多任务统一输出

57

HunyuanVideo-1.5作为一款轻量级视频生成模型,仅需83亿参数即可提供顶级画质,大幅降低使用门槛。该模型在消费级显卡上运行流畅,让每位开发者和创作者都能轻松使用。本代码库提供生成创意视频所需的实现方案与工具集。

54

HunyuanOCR 是基于混元原生多模态架构打造的领先端到端 OCR 专家级视觉语言模型。它采用仅 10 亿参数的轻量化设计,在业界多项基准测试中取得了当前最佳性能。该模型不仅精通复杂多语言文档解析,还在文本检测与识别、开放域信息抽取、视频字幕提取及图片翻译等实际应用场景中表现卓越。

  • 暂无简介
    Python
    1
    0
    NOASSERTION
    更新于 6 小时前
    Star
  • 暂无简介
    0
    0
    NOASSERTION
    更新于 7 小时前
    like
  • 暂无简介
    Python
    0
    0
    更新于 8 小时前
    like
  • SongPrep-7B是腾讯混元推出的开源70亿参数模型,基于百万歌曲数据集训练,支持全歌曲结构解析与歌词转录,提供端到端音频处理能力,适用于音乐分析、歌词生成等场景,助力开发者构建高效音频理解应用
    2
    0
    NOASSERTION
    更新于 8 小时前
    like
  • 暂无简介
    0
    0
    更新于 9 小时前
    like
  • HunyuanWorld-Voyager是腾讯开源的视频扩散框架,能从单张图像出发,结合用户自定义相机路径,生成具有世界一致性的3D点云序列。它可按自定义相机轨迹生成3D一致的场景视频用于世界探索,还能联合生成对齐的深度和RGB视频,实现高效直接的3D重建
    2
    0
    NOASSERTION
    更新于 9 小时前
    like
  • 暂无简介
    Jinja
    0
    0
    更新于 9 小时前
    like
  • 暂无简介
    2
    0
    更新于 9 小时前
    like
  • 暂无简介
    Jinja
    0
    0
    更新于 9 小时前
    like
  • 腾讯混元Hunyuan3D-2mini是轻量级开源3D生成模型,0.6B参数规模较前代1.1B更小更快,支持文本/图像转3D资产,基于扩散模型生成高分辨率纹理3D模型,适用于高效3D内容创作
    1
    0
    NOASSERTION
    更新于 2025年10月17日
    like
查看全部项目 >
公告
暂无公告
成就
747
Star
0
Fork
1.33 M
Download
常用语言
Python
Jinja
Shell