Tag
This paper evaluates chain-of-thought monitoring in AI oversight, finding that providing monitors with a trusted answer improves conclusion-checking but not independent reasoning verification, with implications for AI safety evaluations.
Claim-Level Reliability Assessment (CLR) is a training-free framework that improves reasoning accuracy in LLMs by verifying critical claims instead of sampling more solutions, reducing token use while boosting performance.