Hunyuan3D 2.0:扩展扩散模型以生成高分辨率纹理3D资产
摘要
Hunyuan3D 2.0 是一个可扩展的基于流的扩散变换器系统,用于生成高分辨率纹理3D资产,性能优于当前最先进的模型,并已公开发布代码和权重。
查看缓存全文
缓存时间: 2026/07/12 16:48
论文页面 - Hunyuan3D 2.0:扩展扩散模型以生成高分辨率带纹理的3D资产
来源:https://huggingface.co/papers/2501.12202
发布于 2025年1月21日
·
提交者 https://huggingface.co/akhaliq
AK (https://huggingface.co/akhaliq) 于 2025年1月22日
作者:
,
,
,
,
,
,
,
,
,
,
,
,
,
摘要
Hunyuan3D 2.0 是一个先进的 3D 合成系统,利用基于流的扩散 Transformer 进行形状生成,并利用扩散先验进行纹理合成,在几何细节、条件对齐和纹理质量方面均优于现有模型。
我们提出 Hunyuan3D 2.0,一个先进的 大规模3D合成 (https://huggingface.co/papers?q=3D%20synthesis) 系统,用于生成高分辨率带纹理的 3D 资产。该系统包含两个基础组件:一个大规模 形状生成 (https://huggingface.co/papers?q=shape%20generation) 模型——Hunyuan3D-DiT (https://huggingface.co/papers?q=Hunyuan3D-DiT),以及一个大规模 纹理合成 (https://huggingface.co/papers?q=texture%20synthesis) 模型——Hunyuan3D-Paint (https://huggingface.co/papers?q=Hunyuan3D-Paint)。形状生成模型基于可扩展的流式扩散 Transformer,旨在生成与给定条件图像正确对齐的几何形状,为下游应用奠定坚实基础。纹理合成模型得益于强大的几何和 扩散先验 (https://huggingface.co/papers?q=diffusion%20priors),能够为生成或手工制作的网格生成高分辨率且色彩鲜艳的纹理贴图。此外,我们构建了 Hunyuan3D-Studio (https://huggingface.co/papers?q=Hunyuan3D-Studio)——一个多功能、用户友好的生产平台,简化了 3D 资产的再创作过程。它使专业用户和业余用户都能高效地操作甚至动画化其网格。我们系统地评估了模型,结果表明 Hunyuan3D 2.0 在几何细节、条件对齐、纹理质量等方面均优于之前的最先进模型,包括开源模型和闭源模型。Hunyuan3D 2.0 已公开发布,以填补开源 3D 社区在大规模基础生成模型方面的空白。我们模型的代码和预训练权重可在 https://github.com/Tencent/Hunyuan3D-2 获取。
查看 arXiv 页面 (https://arxiv.org/abs/2501.12202) 查看 PDF (https://arxiv.org/pdf/2501.12202) GitHub 14.2k auto (https://github.com/tencent/hunyuan3d-2) 添加到收藏 (https://huggingface.co/login?next=%2Fpapers%2F2501.12202)
在您的代理中获取此论文:
hf papers read 2501\.12202
没有最新的 CLI?curl \-LsSf https://hf\.co/cli/install\.sh \| bash
引用此论文的模型 (54 个)
tencent/Hunyuan3D-2 图像转3D • 更新于 2025年10月17日 • 94.4k • 1.79k (https://huggingface.co/tencent/Hunyuan3D-2)
tencent/Hunyuan3D-2.1 图像转3D • 更新于 2025年10月17日 • 37.5k • 1.06k (https://huggingface.co/tencent/Hunyuan3D-2.1)
tencent/Hunyuan3D-2mv 图像转3D • 更新于 2025年10月17日 • 3.64k • 416 (https://huggingface.co/tencent/Hunyuan3D-2mv)
tencent/Hunyuan3D-Omni 图像转3D • 更新于 2025年10月17日 • 1.45k • 176 (https://huggingface.co/tencent/Hunyuan3D-Omni)
浏览引用此论文的 54 个模型 (https://huggingface.co/models?other=arxiv:2501.12202) ## 引用此论文的数据集 (1 个)
tencent/HY3D-Bench 更新于 4月9日 • 6.77k • 93 (https://huggingface.co/datasets/tencent/HY3D-Bench)
引用此论文的 Spaces (476 个)
浏览引用此论文的 476 个 Spaces (https://huggingface.co/spaces?arxivIds=2501.12202) ## 包含此论文的收藏集 (33 个)
浏览包含此论文的 33 个收藏集 (https://huggingface.co/collections?paper=2501.12202)
相似文章
@HuggingModels:认识 Hunyuan3D-2——这款开源模型可把 2D 图片秒变完整 3D 资产
Hunyuan3D-2 是一款开源 AI 模型,可将 2D 图片即时转换为完整 3D 资产,无需复杂建模软件。
tencent/HY-World-2.0
HY-World 2.0 是腾讯开源的跨模态3D世界模型,能够从文本、图像和视频中重建和生成3D世界,生成可编辑的3D资产(网格/高斯泼溅),效果与闭源方法相当。
@HuggingPapers: NVIDIA 刚刚在 Hugging Face 上发布了 AnyFlow 首个任意步数视频扩散模型,可生成高质量文本...
NVIDIA 发布了 AnyFlow,这是首个用于文本到视频生成的任意步数视频扩散模型,允许在推理预算(4 到 50 步)之间实现平滑的质量缩放。
FLUX3D: 基于扩散对齐稀疏表示的高保真3D高斯生成
FLUX3D引入了一个框架,通过利用扩散对齐的结构化潜变量和稀疏结构感知的扩散变压器来增强表示学习和跨模态对齐,实现高保真图像到3D高斯泼溅生成,取得了最先进的结果。
SANA-WM: 高效分钟级世界建模与混合线性扩散Transformer
SANA-WM是一个拥有26亿参数的开源世界模型,能生成高保真720p分钟级视频,支持精确相机控制,在达到工业级质量的同时显著降低计算需求。