@oliviscusAI: 这个工具可以跟踪完美的3D运动。rtmlib是一个轻量级姿态估计库,涵盖全身、手部、面部等
摘要
rtmlib是一个轻量级、开源的姿态估计库,支持全身、手部、面部和动物姿态跟踪,基于rtmpose和vitpose模型构建,内置Gradio网页用户界面。
查看缓存全文
缓存时间: 2026/09/15 01:34
这款工具能够精准追踪3D运动轨迹。
rtmlib 是一个轻量级姿态估计库,基于rtmpose和vitpose模型构建,覆盖全身、手部、面部及133点全身追踪功能。
仅需numpy、opencv和onnxruntime即可运行 除人体姿态外,涵盖30种命名动物物种的追踪 内置Gradio网页界面,一键启动脚本 支持CPU/GPU/OpenVINO运行,模型首次使用时自动下载
100% 免费,开源。
相似文章
TrackCraft3R: 改造视频扩散变换器用于密集3D追踪
TrackCraft3R 改造视频扩散变换器,用于从单目视频进行密集3D追踪。它采用双潜在表示和时间RoPE对齐,以比先前方法快1.3倍的速度和少4.6倍的峰值内存,实现了最先进的性能。
@simplifyinAI: 几个知名的3D人体研究项目,HumanNeRF、Neural Body、KeypointNeRF,都依赖于同一个开源工…
EasyMocap是由浙江大学构建的开源工具箱,能够从常规RGB视频中估计3D人体姿态,被HumanNeRF等研究项目使用,但由于SMPL身体模型,存在许可考虑。
Scal3R:用于可扩展在线三维重建的高效多相对姿态查询
Scal3R 通过使用带有轻量级令牌和位姿图优化的多参考相对姿态查询,改善了长视频的在线三维重建,减少了漂移并实现了最先进的性能。
MolmoMotion:语言引导的3D运动预测
MolmoMotion是一种新的语言引导的3D运动预测模型,它从视频帧和动作描述中预测未来的3D点轨迹,性能优于现有方法。同时,该模型还发布了一个大型数据集(MolmoMotion-1M)和一个基准(PointMotionBench)。
DreamTraj:通过读取未渲染视频扩散潜变量生成6DoF物体轨迹
DreamTraj通过解码内部视频扩散潜变量,从单个RGB图像和语言指令预测6自由度物体轨迹,在推理时无需视频、深度或CAD模型。它引入了具有细粒度语言-运动标注的MOVE数据集,实现了最先进的性能,同时运行速度比先生成后提取的流水线快4.6倍。