Hunyuan3D-Omni: A Unified Framework for Controllable Generation of 3D Assets
当前项目代码仓暂无内容
以下内容由 AI 翻译,如有问题请 点此提交 issue 反馈
Hunyuan3D-Omni
Hunyuan3D-Omni 是一个用于可控生成 3D 资产的统一框架,它继承了 Hunyuan3D 2.1 的结构。相比之下,Hunyuan3D-Omni 构建了一个统一的控制编码器,以引入额外的控制信号,包括点云、体素、骨架和边界框。
多模态条件控制
- 边界框控制:生成受 3D 边界框约束的 3D 模型。
- 姿态控制:创建具有特定骨骼姿态的 3D 人体模型。
- 点云控制:在输入点云的引导下生成 3D 模型。
- 体素控制:从体素表示创建 3D 模型。
🎁 模型库
生成过程需要 10 GB 显存。
| 模型 | 描述 | 日期 | 大小 | Huggingface |
|---|---|---|---|---|
| Hunyuan3D-Omni | 具备多模态控制的图像转形状模型 | 2025-09-25 | 3.3B | 下载 |
安装
环境要求
我们的模型在 Python 3.10 版本下进行了测试。
pip install torch==2.5.1 torchvision==0.20.1 torchaudio==2.5.1 --index-url https://download.pytorch.org/whl/cu124
pip install -r requirements.txt
使用方法
推理
多模态推理
python3 inference.py --control_type <control_type> [--use_ema] [--flashvdm]
control_type 参数有四个可用选项:
point:使用点控制类型进行推理。
voxel:使用体素控制类型进行推理。
bbox:使用边界框控制类型进行推理。
pose:使用姿态控制类型进行推理。
--use_ema 标志启用指数移动平均(EMA)模型,以实现更稳定的推理。
--flashvdm 标志启用 FlashVDM 优化,以加快推理速度。
请根据您的需求选择合适的 control_type。例如,如果您想使用 point 控制类型,可以运行:
python3 inference.py --control_type point
python3 inference.py --control_type point --use_ema
python3 inference.py --control_type point --flashvdm
致谢
我们要感谢以下项目的贡献者们,感谢他们开放的研究与探索:TripoSG、CLAY、Trellis、DINOv2、Stable Diffusion、FLUX、diffusers、HuggingFace、CraftsMan3D、Michelangelo、Hunyuan-DiT、HunyuanVideo、HunyuanWorld-1.0、HunyuanWorld-Voyager 以及 PoseMaster。
引用
如果您在研究中使用了本代码,请引用:
@misc{hunyuan3d2025hunyuan3domni,
title={Hunyuan3D-Omni: A Unified Framework for Controllable Generation of 3D Assets},
author={Tencent Hunyuan3D Team},
year={2025},
eprint={2509.21245},
archivePrefix={arXiv},
primaryClass={cs.CV},
url={https://arxiv.org/abs/2509.21245},
}
@misc{hunyuan3d2025hunyuan3d,
title={Hunyuan3D 2.1: From Images to High-Fidelity 3D Assets with Production-Ready PBR Material},
author={Tencent Hunyuan3D Team},
year={2025},
eprint={2506.15442},
archivePrefix={arXiv},
primaryClass={cs.CV}
}
@misc{hunyuan3d22025tencent,
title={Hunyuan3D 2.0: Scaling Diffusion Models for High Resolution Textured 3D Assets Generation},
author={Tencent Hunyuan3D Team},
year={2025},
eprint={2501.12202},
archivePrefix={arXiv},
primaryClass={cs.CV}
}
@misc{yang2024hunyuan3d,
title={Hunyuan3D 1.0: A Unified Framework for Text-to-3D and Image-to-3D Generation},
author={Tencent Hunyuan3D Team},
year={2024},
eprint={2411.02293},
archivePrefix={arXiv},
primaryClass={cs.CV}
}