@HuggingApps: 文本生成动作,能够遵循精确命令和序列"一个人向前走,然后坐在地上" — 一个…
摘要
PRISM是一个拥有14亿参数的文本生成动作模型,能够从文本命令生成精确的动作序列,返回SMPL-X参数,可用于3D绑定。
查看缓存全文
缓存时间: 2026/08/24 16:01
能遵循精确指令和序列的文本转动作模型
“一个人向前走,然后坐到地板上”——模型会按此顺序执行动作 🚶🪑
PRISM(1.4B)为你返回 SMPL-X 参数,方便你绑定到自定义骨骼系统
▶️ 在线体验 https://t.co/sXprTxZ2y0 https://t.co/ofyysWqpKI
PRISM 文本转动作 - hugging-apps 的 Hugging Face Space
来源:https://huggingface.co/spaces/hugging-apps/prism-text-to-motion 正在从 HF Docker 仓库获取元数据...
相似文章
PRISM: 程序化时空推理基准
PRISM是一个大规模基准,包含10,372个人工校准的指令-代码对,用于评估程序化视频生成,并采用了一个漏斗式框架,包含四个指标。对七个大型语言模型的评估揭示了代码可执行性与空间一致性之间存在显著差距。
PRISM:面向共情口语对话的韵律集成多智能体推理框架
PRISM 是一个多智能体框架,通过将语音感知、响应生成和语音合成解耦,并结合韵律线索与大语言模型推理及外部知识工具,以提升共情口语对话的质量。
PRISM:用于顺序决策的感知与推理交织方法
本文介绍了 PRISM,这是一个通过动态问答流程整合视觉-语言模型和大语言模型的框架,旨在提升具身 AI 任务中的顺序决策能力。
PRISM:面向企业对话式AI的基于迭代模拟与监控的提示可靠性框架
PRISM是一个闭环框架,将提示工程视为企业对话式AI的持续可靠性问题。它自动执行测试生成、模拟、评估和修复,实现了99%的可靠性,并将编写时间从几天缩短到几分钟。
@oliviscusAI: 这个工具可以跟踪完美的3D运动。rtmlib是一个轻量级姿态估计库,涵盖全身、手部、面部等
rtmlib是一个轻量级、开源的姿态估计库,支持全身、手部、面部和动物姿态跟踪,基于rtmpose和vitpose模型构建,内置Gradio网页用户界面。