MosMos
摘要
MosMos 是一款语音写作工具,通过语音转文本、区分说话人、添加时间戳,并生成结构化笔记和摘要,从而提升会议生产力。
<p>
适用于会议前、会议中和会议后的语音写作
</p>
<p>
<a href="https://www.producthunt.com/products/mosmos?utm_campaign=producthunt-atom-posts-feed&utm_medium=rss-feed&utm_source=producthunt-atom-posts-feed">讨论</a>
|
<a href="https://www.producthunt.com/r/p/1251122?app_id=339">链接</a>
</p>
查看缓存全文
缓存时间: 2026/09/18 07:49
# MosMos:会前、会中、会后皆实用的语音写作工具 | Product Hunt
来源:https://www.producthunt.com/products/mosmos
MosMos超越了单纯的语音听写功能,将个人思绪与团队对话转化为可直接使用的文字内容。您可在任意应用中自然发声,即时获得按您所选风格生成的精准文本,或指令MosMos联网搜索最新信息。其个性化术语库在您添加专业词汇后便能永久记忆。在多方会议中,它能精确追踪时间戳、识别不同发言者,并生成结构化笔记、摘要、决策记录及待办事项,让后续跟进更轻松高效。
相似文章
@MosiAI_Official: MOSS-Transcribe-Diarize-0.9B 现已在 @huggingface 上开源。采用端到端音频到结构化转录…
MOSS-Transcribe-Diarize-0.9B 是一个开源端到端音频理解模型,用于长篇幅多说话人转录、说话人识别和时间戳生成,由 Mosi AI 在 Apache 2.0 许可下发布。
@YichiZ03: https://x.com/YichiZ03/status/2078588932191895976
MOSS-TD是一个说话人感知的ASR系统,在SGLang-Omni服务栈中进行了优化,能够在单张H100上以约49秒转录38分钟的多说话人音频,并支持16个会议的并发处理。
OpenMOSS-Team/MOSS-TTS-Nano-100M
MOSS-TTS-Nano是一个开源的多语言语音生成模型,仅0.1B参数,专为实时TTS设计,可直接在CPU上运行而无需GPU。由OpenMOSS团队和MOSI.AI发布,它支持简单的本地部署,用于Web服务和产品集成。
Speechmark
Speechmark 是一款私密的 macOS 应用,可在设备端完全本地化地录制、转写并总结会议,支持带有说话者识别的转录稿,并能通过 MCP 服务器与 Claude Code 集成。
OpenMOSS-Team/MOSS-TTS-v1.5 · Hugging Face
MOSS-TTS v1.5是一个更新的开源文本转语音模型,具有改进的多语言合成(支持31种语言)、更稳定的零样本语音克隆以及显式的内联停顿控制。