scene-understanding

标签

Cards List
#scene-understanding

SceneActBench: 智能体能否在其看到的3D场景中执行操作?

Hugging Face Daily Papers · 2026-07-24 缓存

SceneActBench是一个基准测试,用于评估VLM智能体在完整的多对象3D场景中执行操作的能力,通过五个任务中的任务特定几何指标进行评估。

0 人收藏 0 人点赞
#scene-understanding

@thesupermanmx: 中国开源了一个模型,可从普通视频实时重建任意场景的3D模型。只需一个摄像头,无需LiDAR。…

X AI KOLs Timeline · 2026-07-16

中国开源了一个实时3D场景重建模型,无需LiDAR,仅需普通单摄像头视频,在单GPU上实现20 FPS,并在10,000+帧中保持稳定。

0 人收藏 0 人点赞
#scene-understanding

将3D生成模型用于自回归布局生成

Hugging Face Daily Papers · 2026-04-17 缓存

LaviGen是一个框架,它重用3D生成模型进行自回归3D布局生成,使用改进的3D扩散模型和dual-guidance self-rollout蒸馏机制,在LayoutVLM基准上实现了比最先进方法高19%的物理合理性和快65%的计算速度。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈