Tag
This paper resolves a debate on gradient-based data attribution methods for large language models by demonstrating that they primarily track answer format rather than task semantics, challenging their reliability in targeted instruction tuning.