training-data-attribution

标签

Cards List
#training-data-attribution

原型语言模型

arXiv cs.LG · 2026-07-02 缓存

介绍了PRISM,一种原型语言模型架构,它使用稀疏、非负的已学习原型混合体进行可解释的序列建模,实现了具有竞争力的性能,并支持快速训练数据归因和无需微调的模型编辑。

0 人收藏 0 人点赞
#training-data-attribution

STRIDE:通过子集扰动的稀疏恢复进行训练数据归因

Hugging Face Daily Papers · 2026-06-03 缓存

STRIDE是一种用于大型语言模型训练数据归因的新框架,它利用稀疏恢复和引导算子在激活空间中建模功能效应,以13倍于先前方法的速度实现了最先进的准确性。

0 人收藏 0 人点赞
#training-data-attribution

DataDignity:用于大型语言模型的训练数据归属

arXiv cs.AI · 2026-05-08 缓存

本文介绍了 DataDignity,这是一个针对精准溯源(pinpoint provenance)的框架与基准(FakeWiki),旨在识别支持大语言模型(LLM)回答的具体训练数据来源。文章提出了 ScoringModel 和 SteerFuse 两种方法,以在标准检索基线之上提高归属准确率。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈