@SamuelZengML: 语音识别很容易——直到你要求它永远倾听。今日我们开源 Audio8 ASR Infinite:超低延迟…

X AI KOLs Following 工具

摘要

开源 Audio8 ASR Infinite,一种具有超低延迟、无限制音频支持、24/7转录和内置语义轮次检测的语音识别工具,据称是流式ASR的新技术标杆。

语音识别很容易——直到你要求它永远倾听。 今日我们开源 Audio8 ASR Infinite: 超低延迟、无限制音频、24/7转录、无漂移。 内置语义轮次检测,使其像人耳一样倾听。 流式ASR的新技术标杆。https://t.co/gfxAwpxRb0
查看原文
查看缓存全文

缓存时间: 2026/09/23 20:11

语音识别很简单——直到你要求它永不停歇地聆听。

今天,我们开源了 Audio8 ASR Infinite:

超低延迟,无限音频,全天候转录,无漂移。

内置的语义轮次检测让它如同人耳般持续聆听。

流式ASR的最新技术标杆。https://t.co/gfxAwpxRb0

相似文章

Edge0/Audio8-ASR-Infinite

Hugging Face Models Trending

Audio8 ASR Infinite 是一款原生流式语音识别模型,具有可选音频时钟和可配置转录延迟,支持无限长度音频转录且无漂移。

@MaxForAI: 如果你在做语音Agent,你应该试一下这个项目 来自南洋理工、新国立和上海 AI Lab的团队发布了:Mega-ASR 这个完全开源的ASR基于 Qwen3-ASR构建,目的是打破长期困扰ASR的在嘈杂、混响或其他受损现实环境中表现的瓶颈…

X AI KOLs Timeline

南洋理工、新国立和上海 AI Lab 联合发布 Mega-ASR,一个基于 Qwen3-ASR 构建的完全开源 ASR 模型,通过 Voices-in-the-Wild-2M 数据集和渐进式声学到语义优化,在真实世界嘈杂环境中实现最高 30% 的相对词错误率下降,且仅 1.7B 参数可在消费级硬件高效推理。