@MSFTResearch:我们显著扩展了覆盖范围,支持:● 22 种新增语言,现已覆盖 38 个非洲国家…
摘要
微软研究院宣布扩大了其 ASR 模型的覆盖范围,新增了 22 种语言,覆盖 38 个非洲国家,并提供了新的数据集和测试样本。
我们显著扩展了覆盖范围,支持:
● 22 种新增语言,现已覆盖 38 个非洲国家的社区
● 1 个额外的 ASR 模型
● 覆盖范围扩展至 11 个数据集
● 测试样本数量几乎翻倍,用于鲁棒性评估
查看缓存全文
缓存时间: 2026/07/21 20:50
我们显著扩大了覆盖范围,以支持: ● 新增22种语言,现已覆盖38个非洲国家的社区 ● 新增1个ASR模型 ● 覆盖范围扩展至11个数据集 ● 测试样本数量增加了近一倍,用于稳健评估
相似文章
@MSFTResearch: 今天,我们宣布PazaBench的第二个版本发布,这是我们用于评估跨非洲语言自动语音识别(ASR)模型的基准测试。
微软研究院宣布PazaBench的第二个版本发布,这是一个用于评估跨非洲语言自动语音识别模型的基准测试。
@MSFTResearch: 30倍加速分析,从SQL自动生成GPU内核,AI匹配实验室培养的肿瘤模型用于癌症治…
微软研究院在最新的Research Focus通讯中重点介绍了多项进展,包括使用CoddSpeed实现30倍加速分析、AI野生动物重新识别,以及无需重新训练即可跨任务学习的LLM。
从单语到多语:评估Mamba在南非语言中的ASR性能
本文评估了Mamba状态空间模型在七种南非语言上的ASR性能,发现其在资源更少的情况下达到了与Conformer相当的准确率,并探讨了多语训练策略和低资源场景。
加速研究人员和开发者使用新开放数据集构建多语言AI(7分钟阅读)
GitHub宣布推出GitHub多语言仓库数据集,这是一个开放的元数据集,涵盖4000万个仓库中的超过8000万条分类记录,旨在帮助研究人员和开发者构建多语言AI工具。
@MSFTResearch:微软研究院推出了新的工具、模型、仓库和论文。使用AI和智能体?值得关注:• Mage…
微软研究在微软研究论坛虚拟系列中宣布了新的工具、模型、仓库和论文,包括MagenticLite、智能体驱动的GitHub工作流、验证优先的智能体以及语义匹配微调。