preference-ranking

Tag

Cards List
#preference-ranking

A Consensus-Based Framework for Relative Preference Evaluation of Large Language Models

arXiv cs.CL · 5d ago Cached

This paper introduces a consensus-based framework for evaluating LLM responses by having a panel of models rank anonymized outputs, producing a Relative Intelligence Index (RII) as a proxy for relative quality across domains.

0 favorites 0 likes
← Back to home

Submit Feedback