标签
SpatialAvatar-0 提出了一种基于共享 FLAME 网格绑定高斯表示的多阶段重建方法,用于高质量4D头部虚拟形象,在多个基准测试中实现了更优性能,且迭代次数更少。
Avatar V 是一个生产级框架,用于生成行为可识别的虚拟化身视频,基于完整视频参考,引入稀疏参考注意力和运动表示流,在身份保持和唇形同步方面达到最先进水平。
一家中国实验室发布了LongCat-Avatar,这是一款开源工具,只需一张照片和一段音频,就能生成与音频同步的虚拟形象,彻底改变了视频制作方式。