@DanKornas: 想要生成头像视频但不想将面部和语音数据发送到云端服务?Duix.Avatar 是一款本地 AI 工具…
摘要
Duix.Avatar 是一款本地 AI 头像工具包,能够根据视频、语音和脚本输入生成口型同步的头像视频,无需将数据发送到云端。它支持八种语言,并在 GitHub 上以社区许可证发布。
查看缓存全文
缓存时间: 2026/07/25 12:05
想要在不将您的面部和语音数据传输到云服务的情况下生成虚拟人视频?
Duix.Avatar 是一款本地 AI 虚拟人工具包,帮助开发者在自己的 Windows 或 Ubuntu 机器上制作数字人视频。
它通过本地部署的语音和视频服务,将视频样本、语音样本以及脚本或音频输入转化为唇音同步的虚拟人视频。
核心功能: • 本地处理 – 设置完成后无需网络即可运行,源媒体文件保留在您的设备上 • 外貌与语音克隆 – 从真人视频和语音样本创建可复用的虚拟人 • 灵活的驱动输入 – 通过脚本或录音音频生成虚拟人表演 • 八种脚本语言 – 支持英语、日语、韩语、中文、法语、德语、阿拉伯语和西班牙语 • Docker 与本地 API – 提供 Windows 和 Ubuntu 22.04 部署方案,以及音频和视频合成端点
公开 GitHub 仓库,遵循 http://DUIX.COM 社区许可协议;月活用户超过 1000 需获得商业许可。
链接见回复。
Duix:拥有真实面部和语音的第一对话式 AI
来源:https://www.duix.com/ 自定义外观和语音,支持多种语言,无缝集成知识库,大幅提升业务收入。
无需付款。
相似文章
@CopyRebeldia:一家中国实验室刚刚羞辱了半个视频行业。你上传一张照片和一段音频,就能生成一个说话……
一家中国实验室发布了LongCat-Avatar,这是一款开源工具,只需一张照片和一段音频,就能生成与音频同步的虚拟形象,彻底改变了视频制作方式。
Avatar V:可规模化的视频参考虚拟化身视频生成
Avatar V 是一个生产级框架,用于生成行为可识别的虚拟化身视频,基于完整视频参考,引入稀疏参考注意力和运动表示流,在身份保持和唇形同步方面达到最先进水平。
@dflieb: @KeyframeLabs实时视频化身的有趣演示。让AI Garry和AI Dave讨论任何主题,并在聊天中实时提问……
Keyframe Labs实时视频化身的演示,AI角色Garry和Dave可讨论任何话题,并通过聊天实时接收提问。
meituan-longcat/LongCat-Video-Avatar-1.5 · Hugging Face
LongCat-Video-Avatar 1.5 是一个升级的开源框架,用于音频驱动的人像视频生成,具备更优的唇形同步、生产级稳定性及高效的8步推理能力。
@hank_aibtc: https://x.com/victormustar/status/2058492201261244458/video/1… 我操!美团直接把商业闭源Avatar干翻了, 开源免费版LongCat-Video-Avatar-1.5来了! …
美团开源了LongCat-Video-Avatar-1.5模型,支持单张照片和语音生成逼真的说话视频,支持多语言、长视频,性能超越商业闭源方案。