@inworld_ai: Realtime TTS-2 今日正式发布,现为 Artificial Analysis 上排名第一的模型,也是同类中全球最快的TTS。研究预览……
摘要
Inworld AI 正式发布 Realtime TTS-2,宣称其为 Artificial Analysis 上的顶级模型和同类中最快的TTS,代表了公司历史上的重大进步。
查看缓存全文
缓存时间: 2026/09/02 21:58
Realtime TTS-2今日正式上线,现已成为Artificial Analysis平台上排名第一的模型,也是其同类中全球速度最快的语音合成服务。
此前的预研版本使用量远超预期。这些经验反馈至研发环节,使得今日上线的正式版成为Inworld历史上最大的技术飞跃。 https://t.co/xgmYeL5s2x
相似文章
@kwindla:OpenAI 今天发布了一款新的语音到语音模型:gpt-realtime-2 这是首个足够好的语音到语音模型……
OpenAI 发布了 gpt-realtime-2,一款新的语音到语音模型,针对实时语音代理交互和低延迟工具调用进行了优化。
@krandiash: 我们的新TTS模型Sonic-3.6现已全面上线。上周作为AA上的第一模型进入预览,很高兴看到…
Cartesia的TTS模型Sonic-3.6现已全面上线,从架构层面进行了重建,并在预览阶段收到了积极反馈。
@realmrfakename: TTS Arena 已上线。从头重建的语音合成盲测基准 - 听取两个匿名模型,p…
TTS Arena 作为语音合成模型的盲测基准上线,用户比较匿名的 TTS 输出并投票选出更逼真的声音,实时更新排行榜。
@seclink: OpenAI 发布了 GPT-Realtime-2,这是其迄今为止最智能的语音模型。 该模型具备 GPT-5 级别的推理能力、128,000 个 token 的上下文窗口,并支持调节“投入程度”以实现更自然的对话体验。 它可与 GPT-R…
OpenAI发布了GPT-Realtime-2语音模型,具备GPT-5级别的推理能力和128,000 token上下文窗口,支持实时翻译70多种语言到13种输出语言,在Big Bench Audio Intelligence评测中达到96.6%准确率,Greg Brockman称其为语音翻译领域的里程碑。
API 推出全新模型,推动语音智能发展
OpenAI 在 API 中发布了三款全新语音模型:具备高级推理能力的 GPT-Realtime-2、支持实时多语言翻译的 GPT-Realtime-Translate,以及用于流式转录的 GPT-Realtime-Whisper,旨在实现更自然、更具行动力的语音应用。