Higgs Audio v3 TTS 4B。专为语音聊天打造。支持100种语言和内联控制。

Reddit r/LocalLLaMA 模型

摘要

Higgs Audio v3 是一个 4B 参数的 TTS 模型,专为语音聊天应用设计,支持 100 种语言并具备内联控制能力。

暂无内容
查看原文

相似文章

Audio8/Audio8-TTS-Preview-0.6b

Hugging Face Models Trending

Audio8 发布了一款拥有 6 亿参数的多语言文本转语音模型,支持零样本声音克隆功能,在 Hugging Face 上以 Apache 2.0 许可证提供。

ai-sage/GigaChat3.1-Audio-10B-A1.8B · Hugging Face

Reddit r/LocalLLaMA

GigaChat Audio 10B是一个原生音频大语言模型,基于GigaChat 3.1 Lightning构建,集成了Conformer语音编码器和模态适配器,用于音频问答、时间定位和工具使用。