rubric-artifacts

Tag

Cards List
#rubric-artifacts

Judging LLM-as-a-Judge: Concerning Rubric Artifacts in LLM-based Automated Text Generation Evaluation

arXiv cs.CL · 4d ago Cached

This paper demonstrates that rubric text alone can predict LLM judge outputs, challenging the assumption of rubric-based evaluation and raising concerns about its reliability in automated text generation assessment.

0 favorites 0 likes
← Back to home

Submit Feedback