@driscollis: Fish Audio 的 AI 可以在5秒内克隆声音!我认为这对于内容创作来说非常有用,特别是…
摘要
Fish Audio 宣布了其 S2.1 Pro 模型,该模型仅需5秒音频即可克隆声音,同时完成了5200万美元的种子轮融资。
查看缓存全文
缓存时间: 2026/07/29 05:53
Fish Audio 的 AI 可以在5秒内克隆声音!
我认为这对于内容创作来说是一个非常实用的工具,尤其是配音。例如,我很想尝试将其用于屏幕录制。
Fish Audio (@FishAudio): 今天我们筹集了 5200 万美元的种子轮资金,并宣布公开发布 S2.1 Pro。
可以从 5 秒的音频中克隆声音 比 Cartesia 快 2 倍,成本仅为 Eleven Labs 的 1/6 最具表现力的模型,支持对情感、语调、节奏等进行单词级控制
我们
相似文章
@rohanpaul_ai: Fish Audio 刚刚将 S2.1 Pro 免费开放一个月。以下是您需要了解的一切 - 从10秒音频克隆任何声音…
Fish Audio 已将其 S2.1 Pro 语音克隆服务免费开放一个月,支持10-15秒语音克隆、约90毫秒响应时间、83种语言、单词级控制,以及开放权重模型,成本仅为 ElevenLabs 的六分之一。
Fish Audio 推出支持83种语言的S2.1 Pro(2分钟阅读)
Fish Audio 推出S2.1 Pro,这是一款生产级语音模型,具有90毫秒延迟,支持83种语言,可从短样本进行语音克隆,并支持多人对话,可通过API使用,并设有开发免费套餐。
Fish Audio 获得5200万美元种子轮融资,面向创作者和企业构建AI语音模型
Fish Audio 已获得5200万美元种子轮融资,用于面向创作者和企业开发AI语音模型。这家初创公司年经常性收入(ARR)达2100万美元,拥有800万用户,提供开源和付费语音生成模型,包括其最新的S2.1 Pro API。
AI语音克隆诈骗:只需5秒亲人音频样本,受害者损失高达63.5万美元
AI语音克隆诈骗利用低至5秒的音频样本冒充亲人,诈骗受害者高达63.5万美元,凸显了AI技术被滥用于金融欺诈的日益严重趋势。
这个新出的MOSS TTS 1.5语音克隆功能非常厉害
MOSS TTS 1.5是一款具备语音克隆功能的新款文本转语音模型,可通过Hugging Face Space使用。由于其开放许可协议,被认为优于Fish Audio S2 Pro。