training-dataset

Tag

Cards List
#training-dataset

OriginBlame: Record- and Token-Level Data Provenance for AI Training Datasets

arXiv cs.AI · 6d ago Cached

OriginBlame is a record- and token-level data provenance system that propagates author identity through AI training data pipelines, enabling precise forget sets for machine unlearning. It eliminates over-deletion from dataset-level systems and improves unlearning effectiveness.

0 favorites 0 likes
← Back to home

Submit Feedback