我们将3个公开的TTS排行榜合并为一个包含110个模型的综合排名
摘要
一个新的综合排名将三个公开的TTS排行榜合并为一个统一的排名,涵盖110个模型和46个提供商,每周更新并采用固定方法。
Artificial Analysis、Voice Arena和Vapi Humanness Index经常意见不一,因此我们使用一个固定且考虑广度的公式将它们合并。没有编辑调整或供应商权重。110个模型,46个提供商,每周更新。方法和数据在评论中。
相似文章
文本转语音(TTS)基准测试更新:引入客观标准和盲投票(已涵盖46个模型,持续增加中)
更新后的TTS基准测试引入了客观标准和实时盲投票机制,为46+模型创建ELO排名,并向社区开放参与。
@realmrfakename: TTS Arena 已上线。从头重建的语音合成盲测基准 - 听取两个匿名模型,p…
TTS Arena 作为语音合成模型的盲测基准上线,用户比较匿名的 TTS 输出并投票选出更逼真的声音,实时更新排行榜。
部分模型一周内定价相同,于是我观察了人们实际使用的模型
当多个AI模型以相同价格运行一周时,实际的token使用量揭示了与排行榜排名不同的偏好差异,表明编码和通用聊天各有不同的顶级模型,且长上下文使用集中在两个受信任的模型上。
TTS基准对比(截至2026年5月的所有已知TTS)
一个用户创建的用于比较本地TTS工具的基准测试,包含Windows和Mac的结果,Linux测试待完成。包含HTML结果页面和GitHub仓库。
我构建了一个实时排名系统,涵盖所有AI代理和基础模型(开源)
一位开发者推出了AgentTape,这是一个实时排名网站,汇聚来自多个来源(GitHub、Hugging Face、OpenRouter等)的数据,对公开的AI代理和基础模型进行评分和比较,旨在提供超越基准测试的更全面评估。