WorldClaw:大规模智能体式3D开放世界生成
摘要
WorldClaw是一个智能体式由粗到细的框架,能够根据文本提示生成大规模、可探索的3D开放世界,利用规划智能体和地形条件组合来产生连贯的全局结构以及可编辑的实例级资产。
查看缓存全文
缓存时间: 2026/08/07 05:55
论文页面 - WorldClaw:规模化智能体三维开放世界生成
摘要
从开放式文本生成大规模、可自由探索的三维世界仍是一项挑战,因为系统必须同时维持全局空间一致性、丰富的局部内容,以及适合下游编辑和复用的显式资源。我们提出了WorldClaw,一个完全智能体化的、从粗到细的开放世界三维场景生成框架。规划智能体将文本提示转换为包含区域、地形、资源、材质和空间关系的结构化规范。随后,WorldClaw基于语义布局、可复用资源、生成式或程序化材质,以及区域感知的高度场,构建全局一致的地形基础。对于细节要求高的区域,它生成地形条件化的组合,重建可编辑的带纹理网格,并恢复其在地形上的放置位置;基于渲染的智能体进一步细化地形、物体、外观和接触关系。在多样化的开放世界提示下,WorldClaw生成了具有连贯空间组织、视觉吸引力强的局部内容,以及可编辑的实例级资源的大规模场景,同时保持一致的全局地形结构。
查看arXiv页面 (https://arxiv.org/abs/2608.05248) 查看PDF (https://arxiv.org/pdf/2608.05248) 项目页面 (https://tencent-hunyuan.github.io/Hunyuan3D-WorldClaw/) 添加到收藏 (https://huggingface.co/login?next=%2Fpapers%2F2608.05248)
在你的智能体中获取此论文:
hf papers read 2608\.05248
没有最新的CLI?curl \-LsSf https://hf\.co/cli/install\.sh \| bash
引用此论文的模型 0
暂无模型引用此论文
在模型README.md中引用 arxiv.org/abs/2608.05248,即可从此页面链接到该模型。
引用此论文的数据集 0
暂无数据集引用此论文
在数据集README.md中引用 arxiv.org/abs/2608.05248,即可从此页面链接到该数据集。
引用此论文的Space 0
暂无Space引用此论文
在Space README.md中引用 arxiv.org/abs/2608.05248,即可从此页面链接到该Space。
包含此论文的收藏 0
暂无包含此论文的收藏
将此论文添加到收藏 (https://huggingface.co/new-collection),即可从此页面链接到该收藏。
相似文章
WorldAct: 将单体3D世界激活为可交互的以对象为中心的场景
WorldAct是一个框架,利用多模态智能体和几何重建技术,将静态的3D生成环境转换为可编辑、可交互的以对象为中心的场景,支持对象级编辑和具身任务执行。
GenClaw: 代码驱动的智能体图像生成
GenClaw 提出了一种代码驱动的智能体图像生成框架,通过模拟人类的创作过程来打破黑箱范式:概念构思、使用代码(SVG/HTML/Three.js)进行草图绘制,然后利用生成模型添加纹理和实现逼真效果。
SpatialClaw: 重新思考智能体空间推理的动作接口
SpatialClaw是一个无需训练的框架,它采用代码作为动作接口,使视觉语言模型能够进行灵活、有状态的空间推理,在多种3D/4D空间推理任务上取得了卓越性能。
ClawEnvKit:面向类爪智能体的自动环境生成
# 论文页面 - ClawEnvKit:面向类爪智能体的自动环境生成 来源:[https://huggingface.co/papers/2604.18543](https://huggingface.co/papers/2604.18543) ## 摘要 一个自动化流程能够基于自然语言描述,为类爪智能体生成多样化且经过验证的环境,从而实现大规模基准构建与持续评估。为训练和评估类爪智能体构建环境仍然是一个依赖人工的劳动密集型过程,且
OpenClaw 与 Ollama 在智能体 AI 中的应用:迈向全自主且可扩展的 AI 智能体系统
本文提出了智能体 AI 的分层架构分析,以 OpenClaw 和 Ollama 作为全栈原型,展示了自主能力如何从系统集成中涌现,并讨论了运行挑战和未来方向。