factuality-evaluation

Tag

Cards List
#factuality-evaluation

Human-Anchored Factuality Evaluation with Strategic Annotation

arXiv cs.CL · 2026-09-02 Cached

This paper introduces a factuality-specific annotation policy using failure-space analysis to improve human-anchored factuality evaluation for LLMs under limited annotation budgets, achieving significant efficiency gains on benchmark systems.

0 favorites 0 likes
#factuality-evaluation

TriQua: Reconciling Granularity and Context in Factuality Evaluation

arXiv cs.AI · 2026-08-07 Cached

This paper introduces TriQua, a framework for LLM factuality evaluation that adaptively represents facts as triples or hyperrelational facts with contextual qualifiers, along with TriQuaScore for fine-grained factuality scoring. It demonstrates strong alignment with human annotations and improved evidence-based verification over existing methods.

0 favorites 0 likes
← Back to home

Submit Feedback