3d-vision-language

标签

Cards List
#3d-vision-language

Stream3D-VLM:基于增量几何先验的在线3D空间理解

Hugging Face Daily Papers · 2026-06-05 缓存

Stream3D-VLM 是一款在线3D视觉-语言模型,通过增量整合几何先验并使用几何自适应体素压缩,能够从流式视频中实现实时空间理解,在3D空间理解任务上优于现有模型。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈