NovaSynth by Noveum
Summary
NovaSynth by Noveum simulates realistic callers at scale to test voice agents, offering custom scenarios and performance scoring across multiple dimensions.
View Cached Full Text
Cached at: 09/17/26, 07:36 AM
Similar Articles
EVA-Bench Data 2.0: 3 Domains, 121 Tools, 213 Scenarios
ServiceNow AI releases EVA-Bench Data 2.0, an expanded open-source benchmark for evaluating voice agents across 3 enterprise domains (Airline CSM, IT Service Management, Healthcare HRSD) with 213 scenarios and 121 tools, validated against GPT-4.5, Gemini, and Claude.
How does OmniDimension make its AI phone calls sound so natural, fast, and multilingual? Can a solo developer build something similar?
Explores how OmniDimension achieves natural, fast, and multilingual AI phone call synthesis, and discusses the feasibility for solo developers to replicate similar capabilities.
EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents
EVA-Bench introduces a comprehensive end-to-end framework for evaluating voice agents, simulating realistic multi-turn conversations and measuring performance across voice-specific failure modes with novel accuracy (EVA-A) and experience (EVA-X) metrics. The benchmark includes 213 scenarios across enterprise domains and a perturbation suite for accent and noise robustness, revealing substantial gaps in current systems.
SynAE: A Framework for Measuring the Quality of Synthetic Data for Tool-Calling Agent Evaluations
SynAE is a framework for evaluating the quality of synthetic data used in tool-calling agent evaluations, assessing validity, fidelity, and diversity across multiple axes. It addresses challenges of insufficient or sensitive real data by providing metrics to guide synthetic data generation.
A New Framework for Evaluating Voice Agents (EVA)
ServiceNow introduces EVA, a new end-to-end evaluation framework for conversational voice agents that jointly scores task accuracy and conversational experience.