ai-voice

标签

Cards List
#ai-voice

Fish Audio 推出支持83种语言的S2.1 Pro(2分钟阅读)

TLDR AI · 2026-07-29 缓存

Fish Audio 推出S2.1 Pro,这是一款生产级语音模型,具有90毫秒延迟,支持83种语言,可从短样本进行语音克隆,并支持多人对话,可通过API使用,并设有开发免费套餐。

0 人收藏 0 人点赞
#ai-voice

@driscollis: Fish Audio 的 AI 可以在5秒内克隆声音!我认为这对于内容创作来说非常有用,特别是…

X AI KOLs Timeline · 2026-07-28 缓存

Fish Audio 宣布了其 S2.1 Pro 模型,该模型仅需5秒音频即可克隆声音,同时完成了5200万美元的种子轮融资。

0 人收藏 0 人点赞
#ai-voice

Fish Audio 获得5200万美元种子轮融资,面向创作者和企业构建AI语音模型

TechCrunch AI · 2026-07-28 缓存

Fish Audio 已获得5200万美元种子轮融资,用于面向创作者和企业开发AI语音模型。这家初创公司年经常性收入(ARR)达2100万美元,拥有800万用户,提供开源和付费语音生成模型,包括其最新的S2.1 Pro API。

0 人收藏 0 人点赞
#ai-voice

AI的声音

Reddit r/AI_Agents · 2026-07-22

文章讨论了语音技术在人工智能中的重要性。

0 人收藏 0 人点赞
#ai-voice

Retell 对比 Vapi 对比 Plura AI:用于生产环境语音代理,哪个更胜一筹?

Reddit r/AI_Agents · 2026-07-16

对三个语音 AI 代理——Retell、Vapi 和 Plura AI——进行比较,评估它们在生产用例中的表现。

0 人收藏 0 人点赞
#ai-voice

​ElevenLabs 评测 (2026) —— 为什么我给它打 8.1/10(以及谁应该避免付费)

Reddit r/ArtificialInteligence · 2026-07-15

这是一份详尽、非赞助的 ElevenLabs 评测,评分为 8.1/10,突出其情感范围和低延迟等优势,但提醒普通用户和高产量发布者注意高昂的成本和‘再生税’。

0 人收藏 0 人点赞
#ai-voice

GPT新语音模型简直太疯狂了。

Reddit r/singularity · 2026-07-11

OpenAI 的新 GPT 语音模型实现了高度逼真、低延迟的实时语音对话,并具备情感表达能力,标志着 AI 语音交互的一次重大飞跃。

0 人收藏 0 人点赞
#ai-voice

就这样,我们终于实现了AVM最初的承诺

Reddit r/singularity · 2026-07-09

OpenAI终于兑现了AVM最初的承诺,实现了高级语音交互。

0 人收藏 0 人点赞
#ai-voice

@LabSpeculation: GPT-Live 可能会让英语口语老师失业了。 让它当作口语老师,貌似是目前最实用的用法。 “我是一个英语学习者,想通过和你对话练习英语。请你听我说话,只要发现语法错误,或者不够地道的表达,就立刻打断我并纠正。”

X AI KOLs Timeline · 2026-07-09 缓存

GPT-Live 作为 AI 口语老师,能实时纠正语法和不地道表达,可能对英语口语教学产生重大影响。

0 人收藏 0 人点赞
#ai-voice

Netflix在其威利·旺卡真人秀中使用AI生成的吉恩·怀尔德声音

The Verge · 2026-06-30 缓存

Netflix使用ElevenLabs的AI技术,在征得演员家属同意后,为其即将推出的真人秀《旺卡的金色门票》重现了吉恩·怀尔德的声音。

0 人收藏 0 人点赞
#ai-voice

其他泄露都没那么像。ChatGPT Bidi-1 的声音逼真得吓人。

Reddit r/singularity · 2026-06-24

一个泄露版 ChatGPT 搭载了 Bidi-1 语音模式,其声音逼真得令人不安,超过了此前的泄露版本。

0 人收藏 0 人点赞
#ai-voice

@HuggingModels: 想象一个听起来如此自然的文本转语音模型,拥有8200万参数和超过1100万次下载。Kokoro-82M来了,一个…

X AI KOLs Timeline · 2026-06-16 缓存

Kokoro-82M是一个高度自然的文本转语音模型,拥有8200万参数和超过1100万次下载,代表了AI语音生成的重大进步。

0 人收藏 0 人点赞
#ai-voice

@QT9277: 《不是,这AI声音合成已经变态到这种程度了???》 阿台我今天刷GitHub直接懵了。 VoxCPM2,趋势榜第一,星标干到2万+,海外彻底炸了。我本来以为是又一个PPT开源项目,结果仔细看了眼Demo——我耳朵真的分不清哪个是真人了。 …

X AI KOLs Timeline · 2026-06-05 缓存

介绍VoxCPM2,一个完全免费商用、开源的多语言语音合成模型,支持声音设计、克隆及48kHz高质量输出,在GitHub趋势榜第一。

0 人收藏 0 人点赞
#ai-voice

🤖 ElevenLabs 签署协议,利用AI重现斯坦·李的声音和形象

Reddit r/ArtificialInteligence · 2026-05-29

ElevenLabs 与斯坦·李宇宙签署协议,创建斯坦·李的声音和形象的AI克隆,用于数字客串、有声读物和一个读书俱乐部系列,引发了关于同意和剥削的伦理辩论。

0 人收藏 0 人点赞
#ai-voice

@hisevenih: Ai语音圈直接炸锅了。 这个 GitHub 开源黑科技,把 AI 语音做到了离谱的程度, 真正实现了:一句话,一个声音。 记住这个项目名字:VoxCPM2 它在 GitHub 已经拿下了 20K Star。 最夸张的是, 它甚至无需参考音…

X AI KOLs Timeline · 2026-05-28 缓存

GitHub 开源项目 VoxCPM2 实现了无需参考音频的 AI 语音克隆,仅需一句话即可精准生成目标声线,已获 20K Star。

0 人收藏 0 人点赞
#ai-voice

Gmail 即将开始与你对话

The Verge · 2026-05-19 缓存

谷歌宣布推出 Gmail Live,这是一种基于 AI 的语音模式,可通过 Gemini 搜索和操作收件箱。同时,Docs 和 Keep 也将推出类似的语音功能,将于 2026 年夏季向 AI Pro/Ultra 订阅用户开放。

0 人收藏 0 人点赞
#ai-voice

DramaBox by Resemble AI

Product Hunt · 2026-05-14

DramaBox by Resemble AI 将场景描述转换为 AI 生成的人声表演。

0 人收藏 0 人点赞
#ai-voice

@elonmusk: Grok Voice 排名第一!

X AI KOLs Following · 2026-05-12

埃隆·马斯克宣布 Grok Voice 已跃升至第一名。

0 人收藏 0 人点赞
#ai-voice

@nikhilro_:今天,@vapi_ai宣布完成由@peakxvpartners领投的5000万美元B轮融资,总融资额达7200万美元。本轮融资实际上是……

X AI KOLs Following · 2026-05-12 缓存

Vapi_ai宣布完成由Peak XV Partners领投的5000万美元B轮融资,总融资额达7200万美元,重点在于AI语音通话的工程能力。

0 人收藏 0 人点赞
#ai-voice

@Honcia13: 开源TTS直接卷疯了!园区诈骗又有新武器? 清华 OpenBMB 刚刚放出 VoxCPM2: 200亿参数 + 200万小时多语言数据训练,48kHz录音棚级音质! 最狠的是——完全不用Tokenizer,直接在连续潜空间做扩散自回归,细…

X AI KOLs Timeline · 2026-05-12 缓存

清华大学 OpenBMB 发布了 VoxCPM2,这是一个拥有 200 亿参数的开源多语言 TTS 模型,支持无需 Tokenizer 的连续潜空间扩散自回归生成,具备 48kHz 录音棚级音质和强大的声音克隆与设计能力。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈