@simplifyinAI: 几个知名的3D人体研究项目,HumanNeRF、Neural Body、KeypointNeRF,都依赖于同一个开源工…
摘要
EasyMocap是由浙江大学构建的开源工具箱,能够从常规RGB视频中估计3D人体姿态,被HumanNeRF等研究项目使用,但由于SMPL身体模型,存在许可考虑。
查看缓存全文
缓存时间: 2026/08/27 09:55
一些知名的三维人体研究项目如HumanNeRF、Neural Body、KeypointNeRF,底层都依赖同一个开源工具包。
它名为EasyMocap,由浙江大学三维视觉实验室开发。
过去:传统动作捕捉需要标记服、专业设备和专用摄影棚。
现在:EasyMocap能直接从普通RGB视频(甚至包括YouTube片段)估计全身、手部与面部三维姿态,并直接适配研究者常用的现有身体模型。
需要留意:该项目最近一次重大更新是在2021年,且未采用标准的开源许可证标识。
它同样基于SMPL身体模型构建,该模型通常附带非商业学术授权,若计划在研究之外使用,请务必提前核查这两项授权条款。
相似文章
SAM 3D Body:鲁棒的全人体网格恢复
SAM 3D Body 是一个可提示的3D人体网格恢复模型,采用新颖的参数化表示(MHR)和编码器-解码器架构,实现了最先进的性能并具备强泛化能力。该模型支持辅助提示,并且是开源的。
@axichuhai: 这个免费开源的3D动捕工具—freemocap,GitHub 已经斩获 9K star数 不需要专业捕捉设备,只需要几个普通摄像头就可以 它把多视角几何问题转化成了计算机视觉任务,用空间标定算法 + 深度学习模型,从多路普通摄像头的2D画…
Freemocap 是一个免费开源的3D动捕工具,仅需普通摄像头即可通过空间标定和深度学习模型还原精确的3D人体骨骼数据,支持多种格式导出。
@_akhaliq: LingBot-Video 已在 Hugging Face 上发布——基于 MoE 的视频基础模型,专为具身智能打造,300亿参数,仅……
LingBot-Video,一个基于 MoE 的 300 亿参数视频基础模型,专为具身智能设计,已在 Hugging Face 上发布。推理时仅 30 亿参数激活,并额外使用 7 万小时具身数据增强。
HumanNet:将以人为本的视频学习扩展至百万小时规模
HumanNet 是一个包含百万小时标注视频的大规模以人为本的视频数据集,旨在训练视觉-语言-动作模型。它证明了以第一人称视角拍摄的人类视频可以有效地替代机器人数据,用于具身智能任务。
robbyant/lingbot-video-moe-30b-a3b
LingBot-Video是首个面向具身智能的开源大规模MoE视频生成模型,采用高效MoE架构、海量具身数据训练,以及多奖励系统,实现高美学、物理合理性和任务完成度。