Microsoft MAI-Voice-2
摘要
微软发布了 MAI-Voice-2,这是一款支持 15 种语言语音克隆的表现力丰富的文本转语音系统。
<p>
支持15种语言语音克隆的富有表现力的TTS系统
</p>
<p>
<a href="https://www.producthunt.com/products/mai-image-2-3?utm_campaign=producthunt-atom-posts-feed&utm_medium=rss-feed&utm_source=producthunt-atom-posts-feed">讨论</a>
|
<a href="https://www.producthunt.com/r/p/1163789?app_id=339">链接</a>
</p>
相似文章
微软测试新的 MAI Realtime 语音模型(2分钟阅读)
微软正在其 MAI Playground 上以早期访问形式测试一款新的原生实时语音模型 MAI Realtime。该全双工系统支持多种语言、低延迟和可配置的轮流对话,定位为 OpenAI GPT Live 和 Sesame 的竞争对手。
微软推出全新 MAI-Image 和 MAI-Voice(2 分钟阅读)
微软宣布 MAI-Image-2.5-Pro 和 MAI-Voice-2-Flash 公开预览,这是其最新专为图像和语音场景构建的生成式 AI 模型,现已上线 Azure AI,并为必应图像创建器等微软产品提供支持。
k2-fsa/OmniVoice
OmniVoice 是一款大规模多语言零样本文本转语音模型,支持超过 600 种语言,基于扩散语言模型架构构建,具备快速推理和语音克隆能力。
@MosiAI_Official: MOSS-TTS Local Transformer v1.5 现已推出。克隆任意声音。说任何语言。听到每一个细节。30多种语言,48 kHz …
MosiAI发布了MOSS-TTS Local Transformer v1.5,这是一款支持语音克隆、30多种语言以及48 kHz高质量输出的文本转语音模型。
Voiser AI
Voiser AI 提供超过140种语言的人性化AI配音。