@CopyRebeldia:一家中国实验室刚刚羞辱了半个视频行业。你上传一张照片和一段音频,就能生成一个说话……
摘要
一家中国实验室发布了LongCat-Avatar,这是一款开源工具,只需一张照片和一段音频,就能生成与音频同步的虚拟形象,彻底改变了视频制作方式。
一家中国实验室刚刚羞辱了半个视频行业。
你上传一张照片和一段音频,就能得到一个同步说话的虚拟形象。开源。
以前需要机构、摄像机和剪辑的工作,现在看起来就是一个仓库。
它叫LongCat-Avatar。
https://t.co/Ui2l81tNYb
查看缓存全文
缓存时间: 2026/05/31 07:04
一个中国实验室刚刚让半个视频行业颜面扫地。
上传一张照片和一段音频,就能生成一个同步说话的虚拟形象。开源。
以前需要摄影棚、摄像机、剪辑的活,现在看起来只是一个仓库。
它叫 LongCat-Avatar。
https://t.co/Ui2l81tNYb
相似文章
@hank_aibtc: https://x.com/victormustar/status/2058492201261244458/video/1… 我操!美团直接把商业闭源Avatar干翻了, 开源免费版LongCat-Video-Avatar-1.5来了! …
美团开源了LongCat-Video-Avatar-1.5模型,支持单张照片和语音生成逼真的说话视频,支持多语言、长视频,性能超越商业闭源方案。
meituan-longcat/LongCat-Video-Avatar-1.5 · Hugging Face
LongCat-Video-Avatar 1.5 是一个升级的开源框架,用于音频驱动的人像视频生成,具备更优的唇形同步、生产级稳定性及高效的8步推理能力。
@DanKornas: 想要生成头像视频但不想将面部和语音数据发送到云端服务?Duix.Avatar 是一款本地 AI 工具…
Duix.Avatar 是一款本地 AI 头像工具包,能够根据视频、语音和脚本输入生成口型同步的头像视频,无需将数据发送到云端。它支持八种语言,并在 GitHub 上以社区许可证发布。
@victormustar: 新消息:LongCat 刚刚发布了一个优秀的开源说话头像模型(可能是 SOTA)+ MIT 许可,制作了一个 Hugging F…
LongCat 发布了一个开源说话头像模型(可能是最先进的),采用 MIT 许可,并提供了 Hugging Face 演示,可应用于 AI 导师、配音、编码智能体等多种场景。
@LinusEkenstam: 我用10秒视频制作了自己的数字分身。在片段中:左边是我本人,中间是领先的虚拟形象……
Mirage Avatar X by Captions 仅用10秒视频就能创建逼真的数字分身,保留身份特征、表情和举止,且无质量衰减。