Tag
This paper proposes single-prover interactive proofs for AI safety verification, avoiding the need for debate between two competing models, and extends the approach to oracle-aided computations.