NovaSynth 由 Noveum
摘要
NovaSynth 由 Noveum 大规模模拟真实来电者以测试语音代理,提供自定义场景和多维度的性能评分。
<p>
用那些无法模拟的来电者来测试您的语音代理。
</p>
<p>
<a href="https://www.producthunt.com/products/novasynth-by-noveum?utm_campaign=producthunt-atom-posts-feed&utm_medium=rss-feed&utm_source=producthunt-atom-posts-feed">讨论</a>
|
<a href="https://www.producthunt.com/r/p/1237405?app_id=339">链接</a>
</p>
查看缓存全文
缓存时间: 2026/09/17 07:36
# Noveum推出NovaSynth:测试你的语音智能体在无法模拟的通话场景中的表现。| Product Hunt
来源:https://www.producthunt.com/products/novasynth-by-noveum
通过自定义人设、场景、打断、噪音、口音和网络状况,大规模模拟真实来电者。NovaSynth让这些通话与你的语音智能体进行交互,从30多个维度对音频和转录文本进行评分,并向你的团队呈现关键故障点及修复建议。
相似文章
EVA-Bench Data 2.0:3大领域、121个工具、213个场景
ServiceNow AI 发布 EVA-Bench Data 2.0,这是一个扩展的开源基准测试,用于评估语音智能体在3个企业领域(航空客户服务管理、IT服务管理、医疗人力资源服务交付)中的表现,涵盖213个场景和121个工具,并已针对 GPT-4.5、Gemini 和 Claude 进行验证。
OmniDimension如何使其AI电话听起来如此自然、快速且多语言?独立开发者能否构建类似的功能?
探讨OmniDimension如何实现自然、快速且多语言的AI电话合成,并讨论独立开发者复制类似能力的可行性。
EVA-Bench:评估语音代理的新型端到端框架
EVA-Bench 提出了一个全面的端到端评估框架,用于评估语音代理,模拟真实的多轮对话,并通过新颖的准确度(EVA-A)和体验(EVA-X)指标衡量语音特定故障模式下的性能。该基准包含企业领域的 213 个场景以及用于口音和噪声鲁棒性的扰动套件,揭示了当前系统的显著差距。
SynAE:一种用于评估工具调用智能体评测中合成数据质量的框架
SynAE 是一个评估框架,用于衡量工具调用智能体评测中使用的合成数据的质量,从有效性、保真度和多样性等多个维度进行评估。它通过提供指导合成数据生成的指标,应对真实数据不足或敏感带来的挑战。
ServiceNow 推出 EVA:评估语音智能体的新框架
ServiceNow 发布 EVA,这是一个面向对话式语音智能体的端到端评估框架,能够同时评估任务准确率和对话体验。