Tag
This paper introduces safeguard-conditioned uplift, a protocol for measuring how different deployment access conditions (e.g., helpful prompting, safety prompting, external safeguards) affect the utility-risk frontier in dual-use biology AI assistants, based on human-judged evaluations of Claude Sonnet 4.6 and Gemini 3.5 Flash.