untrusted-inputs

Tag

Cards List
#untrusted-inputs

Evaluating using Mock Tool Calls to Quarantine Untrusted Prompt Inputs

arXiv cs.CL · 2026-06-01 Cached

This paper evaluates whether wrapping untrusted content in mock tool calls improves LLM robustness against adversarial inputs, finding it does not broadly help and sometimes increases attack success rates.

0 favorites 0 likes
← Back to home

Submit Feedback