text-to-motion

标签

Cards List
#text-to-motion

ReMoMask-2:潜在检索增强掩码动作生成

Hugging Face Daily Papers · 2026-09-08 缓存

ReMoMask-2通过将检索直接嵌入生成器的潜在空间来改进文本到动作生成,消除表示差距,并在KIT-ML和SnapMoGen等基准测试上实现最先进的结果。

0 人收藏 0 人点赞
#text-to-motion

@vicky_grok: 这太疯狂了!NVIDIA 的文本转动作模型现在无需 NVIDIA 的技术栈就能运行。输入一句话。获得人类动作。在……

X AI KOLs Timeline · 2026-08-29 缓存

NVIDIA 的文本转动作模型已通过 kimodo.cpp 移植到 CPU 上运行,无需 NVIDIA 的技术栈。kimodo.cpp 是一个开源的 GGML/C++ 实现,正迅速获得关注。

0 人收藏 0 人点赞
#text-to-motion

@HuggingApps: 文本生成动作,能够遵循精确命令和序列"一个人向前走,然后坐在地上" — 一个…

X AI KOLs Following · 2026-08-20 缓存

PRISM是一个拥有14亿参数的文本生成动作模型,能够从文本命令生成精确的动作序列,返回SMPL-X参数,可用于3D绑定。

0 人收藏 0 人点赞
#text-to-motion

MUGEN:用于高效运动理解与生成的统一框架

arXiv cs.LG · 2026-07-31 缓存

MUGEN 提出了一个统一的运动-语言框架,避免了离散码本和迭代解码,使用带有连续潜变量槽位的单一自适应长度自编码器以及一次性生成,在 HumanML3D 和 SnapMoGen 基准上实现了高效、高质量的文本到运动与运动到文本性能。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈