@oliviscusAI: 这个工具可以跟踪完美的3D运动。rtmlib是一个轻量级姿态估计库,涵盖全身、手部、面部等

X AI KOLs Following 工具

摘要

rtmlib是一个轻量级、开源的姿态估计库,支持全身、手部、面部和动物姿态跟踪,基于rtmpose和vitpose模型构建,内置Gradio网页用户界面。

这个工具可以跟踪完美的3D运动。 rtmlib是一个轻量级姿态估计库,涵盖全身、手部、面部和133点全身跟踪,基于rtmpose和vitpose模型构建。 > 仅需numpy、opencv和onnxruntime即可运行 > 支持30种命名的动物物种以及人类姿态 > 包含内置Gradio网页用户界面,一个脚本即可启动 > 可在CPU、GPU或OpenVINO上运行,模型首次使用时自动下载 100%免费。开源。
查看原文
查看缓存全文

缓存时间: 2026/09/15 01:34

这款工具能够精准追踪3D运动轨迹。

rtmlib 是一个轻量级姿态估计库,基于rtmpose和vitpose模型构建,覆盖全身、手部、面部及133点全身追踪功能。

仅需numpy、opencv和onnxruntime即可运行 除人体姿态外,涵盖30种命名动物物种的追踪 内置Gradio网页界面,一键启动脚本 支持CPU/GPU/OpenVINO运行,模型首次使用时自动下载

100% 免费,开源。

相似文章

TrackCraft3R: 改造视频扩散变换器用于密集3D追踪

Hugging Face Daily Papers

TrackCraft3R 改造视频扩散变换器,用于从单目视频进行密集3D追踪。它采用双潜在表示和时间RoPE对齐,以比先前方法快1.3倍的速度和少4.6倍的峰值内存,实现了最先进的性能。

MolmoMotion:语言引导的3D运动预测

Hugging Face Blog

MolmoMotion是一种新的语言引导的3D运动预测模型,它从视频帧和动作描述中预测未来的3D点轨迹,性能优于现有方法。同时,该模型还发布了一个大型数据集(MolmoMotion-1M)和一个基准(PointMotionBench)。

DreamTraj:通过读取未渲染视频扩散潜变量生成6DoF物体轨迹

Hugging Face Daily Papers

DreamTraj通过解码内部视频扩散潜变量,从单个RGB图像和语言指令预测6自由度物体轨迹,在推理时无需视频、深度或CAD模型。它引入了具有细粒度语言-运动标注的MOVE数据集,实现了最先进的性能,同时运行速度比先生成后提取的流水线快4.6倍。