@MSFTResearch: 今天,我们宣布PazaBench的第二个版本发布,这是我们用于评估跨非洲语言自动语音识别(ASR)模型的基准测试。
摘要
微软研究院宣布PazaBench的第二个版本发布,这是一个用于评估跨非洲语言自动语音识别模型的基准测试。
今天,我们宣布PazaBench的第二个版本发布,这是我们用于评估跨非洲语言自动语音识别(ASR)模型的基准测试。https://t.co/RLb5SnRQCu
查看缓存全文
缓存时间: 2026/07/21 20:48
今天,我们宣布推出PazaBench的第二版,这是我们用于评估跨非洲语言的自动语音识别(ASR)模型的基准。https://t.co/RLb5SnRQCu
相似文章
@MSFTResearch: 小型语言模型借助SocialRL学会谈判,PazaBench V2将语音AI评估扩展到非洲语言…
微软研究院重点介绍了关于使用SocialRL进行小型语言模型谈判、PazaBench V2用于非洲语言语音评估、EvoLib帮助智能体从经验中学习、改进的A/B测试方法以及AI驱动的精准肿瘤学的新研究。
@MSFTResearch:我们显著扩展了覆盖范围,支持:● 22 种新增语言,现已覆盖 38 个非洲国家…
微软研究院宣布扩大了其 ASR 模型的覆盖范围,新增了 22 种语言,覆盖 38 个非洲国家,并提供了新的数据集和测试样本。
@MSFTResearch:Paza:为低资源和多语言语言构建稳健语音技术的指南,从数据收集…
微软研究院推出了Paza语音手册,这是一份交互式指南,用于为低资源和多语言语言构建稳健的语音技术,涵盖数据收集、模型训练、部署和评估。配套视频介绍了该手册,并演示了如何应用经过验证的实践。
商业ASR系统在代码切换语音上的基准测试:阿拉伯语、波斯语和德语
本文提出了一个基准测试,评估了五个商业ASR系统在阿拉伯语-英语、波斯语-英语和德语-英语代码切换语音上的性能,使用两阶段管道为每个语言对选择300个样本,并通过WER和BERTScore评估性能。ElevenLabs Scribe v2在整体上取得了最低的WER(13.2%)和最高的BERTScore(0.936),并提供公开数据集。
SEA-SpeechBench: 东南亚语音理解的大规模多任务基准测试
SEA-SpeechBench是首个大规模多任务基准测试,用于评估11种东南亚语言的语音理解,揭示了当前模型的性能差距。