Tag
This paper formalizes preference reasoning under indeterminacy in large language models and evaluates state-of-the-art models, revealing systematic failures in distinguishing determined from undetermined instances.