scientific-assistant

Tag

Cards List
#scientific-assistant

$S^3$-Bench: Evaluating Speech Interaction Models as Scientific Voice Assistants

arXiv cs.CL · yesterday Cached

This paper introduces S³-Bench, a systematic evaluation framework for assessing speech interaction models as scientific voice assistants, covering 10 major disciplines and analyzing performance tradeoffs in scientific interactions.

0 favorites 0 likes
#scientific-assistant

SCICONVBENCH: Benchmarking LLMs on Multi-Turn Clarification for Task Formulation in Computational Science

Hugging Face Daily Papers · 2026-05-18 Cached

SCICONVBENCH is a benchmark that evaluates LLMs on multi-turn clarification for ill-posed scientific queries across computational science domains, finding that even frontier models struggle with disambiguation and frequently make silent assumptions.

0 favorites 0 likes
← Back to home

Submit Feedback