标签
PRISM是一个拥有14亿参数的文本生成动作模型,能够从文本命令生成精确的动作序列,返回SMPL-X参数,可用于3D绑定。
ReImagine 提出“图像优先”的可控高质量人体视频生成方案,借助 SMPL-X 动作引导与视频扩散模型,将外观建模与时间一致性解耦。