voice-models

标签

Cards List
#voice-models

Fish Audio 获得5200万美元种子轮融资,面向创作者和企业构建AI语音模型

TechCrunch AI · 2026-07-28 缓存

Fish Audio 已获得5200万美元种子轮融资,用于面向创作者和企业开发AI语音模型。这家初创公司年经常性收入(ARR)达2100万美元,拥有800万用户,提供开源和付费语音生成模型,包括其最新的S2.1 Pro API。

0 人收藏 0 人点赞
#voice-models

@gdb:如果您有兴趣在测试我们的 GPT-Live API 时成为设计合作伙伴(无论是开发创意新应用还是集成到现有产品中),请联系我们——[email protected]

X AI KOLs Timeline · 2026-07-09 缓存

OpenAI 宣布推出 GPT-Live,这是一种新一代的语音模型,用于实现自然的人机交互,即将在 ChatGPT 中推出,并诚邀设计合作伙伴测试 API。

0 人收藏 0 人点赞
#voice-models

@sama: 真是个好视频

X AI KOLs · 2026-07-09 缓存

OpenAI 宣布推出 GPT-Live,这是一种新一代的语音模型,旨在实现自然的人机交互,并已在 ChatGPT 中逐步推出。

0 人收藏 0 人点赞
#voice-models

OpenAI 发布新语音模型,实现更自然的实时对话

TechCrunch AI · 2026-07-08 缓存

OpenAI 发布了新的全双工语音模型 GPT-Live-1 和 GPT-Live-1 mini,旨在实现更自然的实时对话,支持同时说话和聆听,在轮流发言和上下文处理方面有所改进,并取代 ChatGPT 中的 Advanced Voice Mode。

0 人收藏 0 人点赞
#voice-models

实时语音模型在成本(和遗忘)问题上叠加——'Flowcat'同时解决了这两个问题(成本降低4倍,上下文增加7倍)

Reddit r/AI_Agents · 2026-06-24

Flowcat解决了实时语音模型的高成本和有限上下文问题,实现了成本降低4倍、上下文增加7倍的效果。

0 人收藏 0 人点赞
#voice-models

@NielsRogge: 刚把这篇文章作为项目页面添加到 https://paperswithcode.co/paper/2410.00037…!希望更多人能了解……

X AI KOLs Following · 2026-06-18 缓存

NielsRogge 将一篇介绍 Moshi 全双工语音模型的博客作为项目页面添加到了 Papers With Code,旨在让更多人了解这一先进架构。

0 人收藏 0 人点赞
#voice-models

OpenAI的新语音模型不止于回话

Reddit r/ArtificialInteligence · 2026-05-08 缓存

OpenAI推出了三个新的实时音频模型,支持连续、多任务的语音交互,优先考虑长上下文推理、实时翻译和无缝工具使用。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈