3d-reconstruction

标签

Cards List
#3d-reconstruction

@ZiyunClaudeWang: 如果机器人的每一米运动都为重建而优化会怎样?很高兴分享我们的新工作 TRACE,关于主动3D…

X AI KOLs Timeline · 5天前 缓存

TRACE 提出了一种新的主动三维重建方法,通过优化完整的传感器轨迹来实现场景信息的遍历覆盖,相比 next-best-view 基线方法取得了 1.5 dB 的 PSNR 提升。

0 人收藏 0 人点赞
#3d-reconstruction

UniWorld-View:基于视频扩散模型的大基线视图合成

Hugging Face Daily Papers · 2026-08-05 缓存

提出了UniWorld-View,一个用于从单目输入进行大基线新视图合成的统一框架,将遮挡感知的点云渲染与视频扩散模型相结合,以实现精确的相机控制和几何一致性。

0 人收藏 0 人点赞
#3d-reconstruction

@vincieye: 单目视频实时转3D?MAGiSt3R使用多个代理和合并模型(MAGMA)从……重建场景

X AI KOLs Timeline · 2026-07-22 缓存

MAGiSt3R是一个多代理前馈框架,能够以10 FPS的速度从单目RGB视频实现实时3D重建,使用合并模型(MAGMA)结合局部点地图和姿态图优化来减少漂移。

0 人收藏 0 人点赞
#3d-reconstruction

@FinanceYF5: 国内开源了一个模型,随便拍段视频,就能实时重建出3D场景。 一个摄像头,不用LiDAR,1万多帧都不会崩,单卡就能跑到20fps。跑分比传统优化类方法更强,无人机航拍、行车记录、室内漫游都测过。 而且完全开源。

X AI KOLs Timeline · 2026-07-20 缓存

国内开源了一个模型,仅用单摄像头拍摄的视频即可实时重建3D场景,无需LiDAR,单卡运行达20fps,性能优于传统优化方法,并完全开源。

0 人收藏 0 人点赞
#3d-reconstruction

面向插花的四维数字档案设计

Hacker News Top · 2026-07-19 缓存

本文提出了一种四维数字观看系统,用于存档插花创作过程。该系统采用同步摄像头、眼动追踪和3D高斯泼溅(3D Gaussian Splatting)技术,支持从任意角度交互式观看。

0 人收藏 0 人点赞
#3d-reconstruction

@huchris007: 梁思成1933年考察应县木塔,他在塔下给林徽因写信,说这塔好到让他恨不得她当场看见。 我去年3月也去看了一眼,确实震撼。 昨晚,我用Kimi K3重建了数字版的应县木塔。 10611个组件,晨、午、暮、夜四个光照场景,K3一次完成,牛逼!

X AI KOLs Timeline · 2026-07-19 缓存

用户使用Kimi K3模型重建了应县木塔的数字版,包含10611个组件和晨、午、暮、夜四个光照场景,展示了该模型的3D重建能力。

0 人收藏 0 人点赞
#3d-reconstruction

@thesupermanmx: 中国开源了一个模型,可从普通视频实时重建任意场景的3D模型。只需一个摄像头,无需LiDAR。…

X AI KOLs Timeline · 2026-07-16

中国开源了一个实时3D场景重建模型,无需LiDAR,仅需普通单摄像头视频,在单GPU上实现20 FPS,并在10,000+帧中保持稳定。

0 人收藏 0 人点赞
#3d-reconstruction

修复长距离单次条纹投影轮廓术中的形状先验捷径

arXiv cs.LG · 2026-07-15 缓存

介绍了PhiCalNet,一种用于单次条纹投影轮廓测量的神经网络,通过输出包裹相位并使用固定校准层来避免形状先验捷径,在合成基准测试中实现了比基线UNet低3.3倍的误差。

0 人收藏 0 人点赞
#3d-reconstruction

在深度相机眼中,玻璃墙基本上是空的。这个模型能把它填补回来。

Reddit r/singularity · 2026-07-07

提出了一种模型,用于填补深度相机在遇到玻璃墙等透明表面时缺失的深度数据,解决了常见的传感器局限性。

0 人收藏 0 人点赞
#3d-reconstruction

PixWorld:在像素空间中统一3D场景生成与重建

Hugging Face Daily Papers · 2026-07-06 缓存

PixWorld提出了一种统一的像素空间扩散方法,用于3D场景重建与生成,通过直接的图像级监督和几何感知特征对齐,克服了潜在空间方法的局限性。该方法优于先前的生成方法,并达到了与最先进的重建方法相当的性能。

0 人收藏 0 人点赞
#3d-reconstruction

@FinanceYF5: 有人把Blender连到Fable 5,大概20分钟,它就把整个纽约市的建筑群重建出来了。 它没有直接瞎画,是先从公开数据源抓了建筑数据,再照着数据建模——理论上整套模型是等比例的。 发布者说这个"先查数据再动手"的思路,比Opus 4.…

X AI KOLs Following · 2026-07-04 缓存

有人将Blender连接到Fable 5,仅用20分钟就基于公开建筑数据重建了纽约市建筑群,模型等比例。发布者认为这种“先查数据再动手”的思路比Opus 4.8更智能,体现了AI开始具备“做功课”的能力。

0 人收藏 0 人点赞
#3d-reconstruction

PointDiT: 像素空间扩散用于单目几何估计

Hugging Face Daily Papers · 2026-07-02 缓存

PointDiT提出了一种极简的像素空间扩散变换器,使用纯ViT架构进行单目几何估计,在超越复杂基于潜空间模型的同时,在模糊区域保持简洁性和鲁棒性。

0 人收藏 0 人点赞
#3d-reconstruction

场景即对象,而非基元:来自无位姿视图的实例结构化3D令牌化

Hugging Face Daily Papers · 2026-06-28 缓存

本文提出了一种前馈框架,能够从无位姿的多视图图像中将3D场景分解为实例结构的令牌组,从而在没有3D标注的情况下实现直接的对象级重建、分割和操控。

0 人收藏 0 人点赞
#3d-reconstruction

Lift4D:协调单视角3D估计用于野外4D重建

Hacker News Top · 2026-06-23 缓存

Lift4D是一个测试时优化框架,能够从单目野外视频中重建动态物体的完整4D几何、外观和形变,在具有遮挡和非刚性运动的挑战性序列上优于先前方法。

0 人收藏 0 人点赞
#3d-reconstruction

立方体、本轮与人脸

Lobsters Hottest · 2026-06-20 缓存

本文描述了一个项目,利用傅里叶级数和本轮在立方体的三个面上重建人脸,展示了正弦波如何生成复杂形状。

0 人收藏 0 人点赞
#3d-reconstruction

GeneralVLA-2:几何感知重建与受控记忆用于机器人规划

Hugging Face Daily Papers · 2026-06-16 缓存

GeneralVLA-2 引入了 GeoFuse-MV3D 以改进 3D 重建,以及一个受控的 KnowledgeBank 以在机器人操作任务中实现更好的记忆管理,在多个基准测试上取得了性能提升。

0 人收藏 0 人点赞
#3d-reconstruction

SpatialAvatar-0:基于多阶段重建的高质量4D头部虚拟形象

Hugging Face Daily Papers · 2026-06-14 缓存

SpatialAvatar-0 提出了一种基于共享 FLAME 网格绑定高斯表示的多阶段重建方法,用于高质量4D头部虚拟形象,在多个基准测试中实现了更优性能,且迭代次数更少。

0 人收藏 0 人点赞
#3d-reconstruction

World Tracing:超越可见的生成式像素对齐几何

Hugging Face Daily Papers · 2026-06-11 缓存

World Tracing 引入了一种生成式像素对齐几何表示,它在预测与观测像素对齐的3D点的同时,补全被遮挡的表面。它使用一个经过像素空间流匹配训练的扩散Transformer,在物体、场景和动态基准测试中的可见表面重建和完整几何生成上取得了强劲性能。

0 人收藏 0 人点赞
#3d-reconstruction

Surflo:具有全局状态的一致3D表面流模型

Hugging Face Daily Papers · 2026-06-11 缓存

Surflo是一种前馈3D重建模型,它将未定姿的RGB视图压缩成潜在标记,并通过流匹配解码出一致的3D表面点,支持可变分辨率输出,在速度上优于现有方法。

0 人收藏 0 人点赞
#3d-reconstruction

BA-T: 一种用于两视图束调整的迭代Transformer

Hugging Face Daily Papers · 2026-06-02 缓存

BA-T是一种用于两视图束调整的迭代Transformer架构,通过轻量设计仅使用传统解码器16%的参数,提升3D重建精度和跨视图一致性,性能与更大模型相当甚至更优。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈