@iluciddreaming: 别急着给 AI avatar 交月费。 开源已经能做到: 一张照片 + 一段音频 = 会说话的视频。 免费,自己架。 平台卖的,本质就是这个。 仓库链接在 reply。

X AI KOLs Timeline 工具

摘要

这篇推文指出,开源方案已经可以用一张照片和一段音频生成说话的视频,无需付费订阅AI头像平台,仓库链接在回复中。

别急着给 AI avatar 交月费。 开源已经能做到: 一张照片 + 一段音频 = 会说话的视频。 免费,自己架。 平台卖的,本质就是这个。 仓库链接在 reply。 https://t.co/Hu26D4rtY3
查看原文
查看缓存全文

缓存时间: 2026/08/04 04:03

别急着给 AI avatar 交月费。

开源已经能做到: 一张照片 + 一段音频 = 会说话的视频。

免费,自己架。 平台卖的,本质就是这个。

仓库链接在 reply。 https://t.co/Hu26D4rtY3

相似文章

@gkxspace: 我每月 AI 订阅两三千,其中有些是TTS、ASR之类的,主流的几家都挺贵,API协议也都不一样 我一直在想有没有可以一个套餐做到: 语音复刻、会议转写、AI 播客生成、实时语音问答、语音输入、写代码 可算找到了一个活菩萨,阶跃星辰的 S…

X AI KOLs Timeline

阶跃星辰推出Step Plan订阅服务,月费6.99美元,整合了LLM、TTS、ASR、图像生成等多种AI模型,支持OpenAI SDK直连,可用于语音复刻、会议转写、AI播客生成等场景。

@denziideng: 无审查、无限制的开源AI图像视频神器来了,这个解恨啊 想用 Flux、Kling、Sora、Veo 等顶级模型生成图片和视频,却受平台审核限制、还要付费订阅?现在有一个开源项目直接把这些功能全开源了。 Open-Generative-AI…

X AI KOLs Timeline

Open-Generative-AI 是一个开源的多媒体创作平台,集成了200多个生成模型,支持图像、视频、唇同步等功能,无内容过滤,可本地或云端运行,完全免费。

@laowangbabababa: 震惊了,抖音上祁博士一天卖 50w 的数字人 agent,我2 分钟就开发完成了。 用的就是Pixelle-Video这个项目,已经22k stars。包括数字人口播、动作迁移、图生视频全支持。 支持ComfyUI,输入主题,从写脚本到加…

X AI KOLs Timeline

介绍开源项目Pixelle-Video:一个全自动AI短视频引擎,输入主题即可自动生成带文案、配图、语音和背景音乐的视频,支持本地和云端模型,模块化设计可灵活替换各环节模型。

@uniswap12: 微软开源了一个语音 AI,60 分钟长音频一次转写,4 个人同时说话都能搞定 VibeVoice,微软开源,24.8k star,今天才知道这个。录音一键转文字这件事,我之前一直用 Whisper,但它处理长会议录音经常超时,多人说话识别…

X AI KOLs Timeline

微软开源了语音AI框架VibeVoice,支持60分钟长音频一次性转写、多说话人分离和时间戳标注,同时提供多角色TTS合成能力,底层基于Qwen2.5并配有0.5B轻量实时版本,已在GitHub获得24.8k星标。