标签
CE3D++ 通过哈希图集网络将2D编辑与3D重建解耦,并利用大语言模型自主调用视觉工具,实现了灵活的对话驱动式3D和4D场景编辑。
VGGT-Edit 提出了一种基于深度同步文本注入和残差场预测的前馈框架,用于文本驱动的原生3D场景编辑,相较于2D提升方法,实现了更优的质量和效率。