Xetrieval: 稠密检索的机械性解释
摘要
Xetrieval 是一个机械性框架,通过用推理信息增强句子嵌入并将其分解为可解释的稀疏特征来解释稠密检索,从而在不进行昂贵自回归生成的情况下提供检索决策的特征级解释。
查看缓存全文
缓存时间: 2026/05/29 15:02
论文页面 - Xetrieval:密集检索的机理解释
来源:https://huggingface.co/papers/2605.29507
摘要
Xetrieval 是一个机理性框架,通过向句子嵌入注入推理信息并将其分解为可解释的稀疏特征,来解释密集检索中的决策。
解释为什么密集检索器(https://huggingface.co/papers?q=dense%20retrievers)会赋予高相关性分数仍然具有挑战性,因为检索决策(https://huggingface.co/papers?q=retrieval%20decisions)是通过不透明的高维嵌入(https://huggingface.co/papers?q=high-dimensional%20embeddings)做出的。现有解释通常聚焦于表层信号,如词汇匹配、词元对齐或事后文本理由,因此对形成密集检索行为的嵌入层潜在因素洞察有限。我们提出 Xetrieval,一个嵌入层的密集检索机理解释框架。Xetrieval 首先引入一个轻量级的推理内化器(https://huggingface.co/papers?q=reasoning%20internalizer),该内化器通过单次前向传播在嵌入空间(https://huggingface.co/papers?q=embedding%20space)中近似思维链推理(https://huggingface.co/papers?q=Chain-of-Thought%20reasoning),从而在避免昂贵的自回归生成的同时,用推理导向信息丰富句子嵌入。然后,它将这些推理增强的嵌入分解为稀疏的、人类可解释的特征(https://huggingface.co/papers?q=human-interpretable%20features),每个特征都与一段连贯的自然语言描述相关联。通过聚合多个文档视角下的稀疏特征重叠,Xetrieval 为单个检索决策(https://huggingface.co/papers?q=retrieval%20decisions)提供特征级解释(https://huggingface.co/papers?q=feature-level%20explanations)。在多种检索器和基准上的实验表明,Xetrieval 能发现连贯的可解释特征,产生更强的成对级干预效应(https://huggingface.co/papers?q=pair-level%20intervention%20effects),并支持任务级特征导向(https://huggingface.co/papers?q=task-level%20feature%20steering)。项目页面和源代码见 https://hihiczx.github.io/Xetrieval 。
查看 arXiv 页面(https://arxiv.org/abs/2605.29507)查看 PDF(https://arxiv.org/pdf/2605.29507)项目页面(https://hihiczx.github.io/Xetrieval/)GitHub12(https://github.com/Hihiczx/Xetrieval)添加到收藏(https://huggingface.co/login?next=%2Fpapers%2F2605.29507)
在您的代理中获取此论文:
hf papers read 2605.29507
没有最新的 CLI?curl -LsSf https://hf.co/cli/install.sh | bash
引用该论文的模型0
没有模型关联该论文
请在模型 README.md 中引用 arxiv.org/abs/2605.29507,以便在此页面中链接。
引用该论文的数据集0
没有数据集关联该论文
请在数据集 README.md 中引用 arxiv.org/abs/2605.29507,以便在此页面中链接。
引用该论文的 Space0
没有 Space 关联该论文
请在 Space README.md 中引用 arxiv.org/abs/2605.29507,以便在此页面中链接。
包含该论文的收藏集0
没有收藏集包含该论文
请将此论文添加到一个收藏集(https://huggingface.co/new-collection)中,以便在此页面中链接。
相似文章
DREAM:通过自回归建模实现密集检索嵌入
DREAM通过利用自回归语言模型的注意力来监督查询-文档相似度,从而训练密集检索嵌入,无需标注数据。在不同模型规模下,它在BEIR和RTEB基准测试上始终优于基线。
@_reachsumit: Latent Terms: 密集检索器包含可轻松提取的BM25就绪齐普夫词汇表 @bclavie 等人提取中…
该论文提出 Latent Terms 方法,使用稀疏自编码器从冻结的密集检索器中提取BM25就绪的稀疏特征,无需检索特定训练即可实现有竞争力的性能。
密集检索的检索锚定潜在推理
提出检索锚定潜在推理(RGLR),一种面向密集检索的潜在推理框架,它显式地将中间潜在转移与检索改进联系起来,在推理密集型任务上优于基线方法。
重新思考推理密集型检索:评估并提升智能体搜索系统中的检索器
本文引入了 BRIGHT-Pro,这是一个针对推理密集型检索的新基准,以及 RTriever-Synth,这是一个用于微调 RTriever-4B 以在智能体搜索系统中提升性能的合成语料库。
为什么先进编码器在稀疏检索上落后?答案及弥合词汇差距的方法
本文指出词汇差距是导致ModernBERT等先进编码器在学习型稀疏检索中表现不佳的根本原因,并提出词汇迁移(VT)这一模型无关框架,将编码器迁移至稀疏友好的词汇表,在BEIR基准测试上取得最优结果。