3d-reconstruction

标签

Cards List
#3d-reconstruction

Surflo:具有全局状态的一致3D表面流模型

Hugging Face Daily Papers · 2026-06-11 缓存

Surflo是一种前馈3D重建模型,它将未定姿的RGB视图压缩成潜在标记,并通过流匹配解码出一致的3D表面点,支持可变分辨率输出,在速度上优于现有方法。

0 人收藏 0 人点赞
#3d-reconstruction

BA-T: 一种用于两视图束调整的迭代Transformer

Hugging Face Daily Papers · 2026-06-02 缓存

BA-T是一种用于两视图束调整的迭代Transformer架构,通过轻量设计仅使用传统解码器16%的参数,提升3D重建精度和跨视图一致性,性能与更大模型相当甚至更优。

0 人收藏 0 人点赞
#3d-reconstruction

Blender思维:基于视觉语言模型的分阶段可执行逆图形

Hugging Face Daily Papers · 2026-06-01 缓存

本文介绍了SEIG,这是一个利用预训练视觉语言模型从单张图像重建3D场景的框架,通过逐步细化几何、材质、构图和光照,将场景重建为可编辑的Blender程序。

0 人收藏 0 人点赞
#3d-reconstruction

SurGe:点地图中改进的表面几何

Hugging Face Daily Papers · 2026-05-29 缓存

SurGe引入了一个Neighborhood Attention Decoder和一种重新制定的尺度不变梯度匹配损失,以改进前馈式3D重建中的局部表面几何精度,特别是对于薄结构。它在零样本单目几何基准测试中取得了最先进的平均排名,并在局部点图和法线度量方面表现更好。

0 人收藏 0 人点赞
#3d-reconstruction

从实况画面重建不同视角

Reddit r/singularity · 2026-05-25

4D Gaussian Splatting 是一种将平面2D图像转换为三维空间数据的技术,能够从实况画面重建不同视角。

0 人收藏 0 人点赞
#3d-reconstruction

用于鲁棒多视图三维重建的几何感知表示去噪

Hugging Face Daily Papers · 2026-05-25 缓存

提出GARD,一种基于扩散的框架,在前馈三维重建器的特征空间中操作,从退化输入中联合恢复场景几何和高质量图像。

0 人收藏 0 人点赞
#3d-reconstruction

TriSplat:面向仿真的前馈式三维场景重建

Hugging Face Daily Papers · 2026-05-25 缓存

TriSplat是一种前馈式三维重建网络,利用有向三角形图元直接从单张图像生成可直接用于仿真的网格,省去了昂贵的后处理步骤。该方法在保持竞争性的新视角渲染质量的同时,实现了几何保真的重建。

0 人收藏 0 人点赞
#3d-reconstruction

HorizonStream: 长视界注意力用于流式三维重建

Hugging Face Daily Papers · 2026-05-22 缓存

HorizonStream 提出一种用于流式三维重建的长视界注意力机制,该机制通过证据影响核显式建模几何传播,在恒定内存和线性时间复杂度下实现稳定、可扩展的重建,并能泛化到超过10,000帧的序列。

0 人收藏 0 人点赞
#3d-reconstruction

GenRecon:结合生成先验的多视图3D场景重建

Hugging Face Daily Papers · 2026-05-22 缓存

GenRecon提出了一种3D场景重建方法,将生成式3D先验与多视图图像条件相结合,实现了室内环境的高保真、可编辑网格重建,性能比现有方法提升16%。

0 人收藏 0 人点赞
#3d-reconstruction

SceneAligner:基于3D场景的真实世界平面图定位

Hugging Face Daily Papers · 2026-05-21 缓存

介绍SceneAligner,一种用于平面图定位的深度学习方法,利用3D场景重建和跨模态对应学习,在数据有限的真实环境中工作。

0 人收藏 0 人点赞
#3d-reconstruction

UniT:基于分组自回归Transformer的统一几何学习

Hugging Face Daily Papers · 2026-05-20 缓存

UniT是一种统一的几何感知前馈模型,采用分组自回归Transformer,集成了多种范式(在线/离线、多模态、长时域),同时通过自适应尺度损失和队列式KV缓存保持度量尺度精度。它在涵盖七个任务的十个基准上取得了最先进性能。

0 人收藏 0 人点赞
#3d-reconstruction

草莓的高斯溅射

Hacker News Top · 2026-05-19 缓存

一个草莓的高斯溅射模型,从90个视角通过焦点堆叠创建,使用slang-splat进行训练并使用SuperSplat进行查看。

0 人收藏 0 人点赞
#3d-reconstruction

庞贝遇难者被鉴定可能为医生

Ars Technica · 2026-05-18 缓存

考古学家利用CT扫描和3D重建技术,将一名庞贝遇难者鉴定为可能是一位罗马医生。

0 人收藏 0 人点赞
#3d-reconstruction

EgoForce: 前臂引导的相机空间3D手部姿态——来自单目第一人称相机

Hugging Face Daily Papers · 2026-05-12 缓存

EgoForce是一个单目3D手部重建框架,使用统一网络,包含可微分前臂表示、手臂-手部变换器和射线空间求解器,能够在不同相机模型下恢复绝对手部姿态和位置,在多个第一人称基准测试中达到了最先进的精度。

0 人收藏 0 人点赞
#3d-reconstruction

Lite3R:一种高效的模型无关前馈3D重建框架

Hugging Face Daily Papers · 2026-05-12 缓存

Lite3R 是一个模型无关框架,通过稀疏线性注意力和 FP8 感知量化,提升了基于 Transformer 的 3D 重建效率。在保持 VGGT 和 DA3-Large 等主干网络几何精度的同时,它将延迟和内存占用降低了高达 2.4 倍。

0 人收藏 0 人点赞
#3d-reconstruction

MoCam:通过结构化去噪动态实现统一的新视角合成

Hugging Face Daily Papers · 2026-05-12 缓存

MoCam 是一篇研究论文,介绍了一种基于扩散的统一新视角合成框架,该框架通过动态协调几何和外观先验,提高了对几何误差的鲁棒性。

0 人收藏 0 人点赞
#3d-reconstruction

VidSplat:利用几何引导的视频扩散先验进行高斯泼溅重建

Hugging Face Daily Papers · 2026-05-12 缓存

VidSplat 是一种无需训练的生成式重建框架,它利用视频扩散先验,通过合成新视角,从稀疏输入中恢复完整的 3D 场景。

0 人收藏 0 人点赞
#3d-reconstruction

@om_patel5:这家伙用 Claude Code 做了个真正的 3D 房产导览工具,而不是 Matterport 那种虚假的 360 度照片拼接

X AI KOLs Timeline · 2026-05-08

有人利用 Claude Code 创建了一个工具,能从现有的图像捕捉生成真正的交互式 3D 房产导览,旨在取代 Matterport 这类昂贵的硬件和订阅服务。

0 人收藏 0 人点赞
#3d-reconstruction

TT4D:一种基于单目视频进行乒乓球4D重建的Pipeline与数据集

Hugging Face Daily Papers · 2026-05-02 缓存

本文介绍了TT4D,这是一种新颖的Pipeline和大规模数据集,旨在从单目视频中重建乒乓球比赛的4D场景。该方案采用独特的“先升维”策略,在进行时间分割之前,先估计乒乓球的3D轨迹和旋转,从而即使在存在遮挡的情况下也能实现稳健的重建。

0 人收藏 0 人点赞
#3d-reconstruction

AnyRecon:基于视频扩散模型的任意视角 3D 重建

Hugging Face Daily Papers · 2026-04-21 缓存

AnyRecon 提出了一种可扩展框架,利用具备持久场景记忆与几何感知条件的视频扩散模型,从任意稀疏输入进行 3D 重建。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈