Tag
This paper identifies a vulnerability in Large Language Models called Semantic Camouflage and proposes Latent Intent Verification, a lightweight probing defense that significantly improves detection rates against adversarial attacks.