multi-view

标签

Cards List
#multi-view

基于多视角基础模型的统一全景几何估计

Hugging Face Daily Papers ↗ · 2026-05-25 缓存

PaGeR 适配了多视角透视基础模型 Depth Anything 3,利用固定的立方体贴图表示,从单张等距柱状投影图像中预测尺度不变深度、度量深度、表面法线和天空分割,同时保持 VRAM 和运行时间恒定。本文还发布了 ZüriPano 和 PanoInfinigen 数据集。

0 人收藏 0 人点赞
#multi-view

用于鲁棒多视图三维重建的几何感知表示去噪

Hugging Face Daily Papers ↗ · 2026-05-25 缓存

提出GARD,一种基于扩散的框架,在前馈三维重建器的特征空间中操作,从退化输入中联合恢复场景几何和高质量图像。

0 人收藏 0 人点赞
#multi-view

GenRecon:结合生成先验的多视图3D场景重建

Hugging Face Daily Papers ↗ · 2026-05-22 缓存

GenRecon提出了一种3D场景重建方法,将生成式3D先验与多视图图像条件相结合,实现了室内环境的高保真、可编辑网格重建,性能比现有方法提升16%。

0 人收藏 0 人点赞
#multi-view

参数高效的多视角熟练度评估:从判别式分类到生成式反馈

Hugging Face Daily Papers ↗ · 2026-05-05 缓存

本文针对 Ego-Exo4D 数据集提出了三种参数高效的多视角熟练度评估方法,实现了从判别式分类到生成式反馈的转变。与基于视频 Transformer 的基线模型相比,所提出的模型在参数量和训练轮次大幅减少的同时,取得了最先进的准确率。

0 人收藏 0 人点赞
#multi-view

MultiWorld:可扩展的多智能体多视角视频世界模型

Hugging Face Daily Papers ↗ · 2026-04-20 缓存

MultiWorld 是一个统一的多智能体多视角视频世界建模框架,通过多智能体条件模块与全局状态编码器,在精准控制多智能体行为的同时保持多视角一致性。

0 人收藏 0 人点赞
← Previous
← 返回首页

提交意见反馈