按许可证分类的开源 TTS 参考指南 — (因为一半的顶级开放权重模型无法用于商业用途)
摘要
一份按许可证类型组织的开源文本转语音模型参考指南,重点指出哪些模型可用于商业用途。
暂无内容
相似文章
终极清单:最佳开源代码、对话、视觉、音频等模型
精选开源模型清单,涵盖代码、对话、视觉、音频、语音合成、声音克隆、音乐、图像与视频生成,附链接与性能简评。
文本转语音(TTS)基准测试更新:引入客观标准和盲投票(已涵盖46个模型,持续增加中)
更新后的TTS基准测试引入了客观标准和实时盲投票机制,为46+模型创建ELO排名,并向社区开放参与。
主要开源权重模型发布(按许可证和基准分组,截至2026年7月)
截至2026年7月的主要开源权重模型发布汇编,按许可证类型(Apache 2.0、MIT、自定义、修改版MIT)分组,并附有相关基准测试。
@vvolhejn: 我们的开源TTS变得更加开源了
Kyutai Labs 已经开源了他们的 Pocket TTS 训练工具集,包括数据流水线、训练方案和评估,允许开发者在GPU上训练文本转语音模型并在CPU上运行。
TontaubeV1 - 本地长篇生成开放语音合成模型发布
TontaubeV1 是一个开放权重的语音合成模型,专为本地长篇生成发布,支持英语和德语,具备零样本语音克隆功能,并可在 GPU 上实现低延迟推理。