面向自演化智能文献检索

Hugging Face Daily Papers 论文

摘要

PaSaMaster 是一个自演化智能文献检索系统,通过迭代优化搜索意图并生成基于证据的论文排序,以1%的成本实现比GPT-5.2提升30%的性能,且零幻觉。

随着大语言模型重塑科学研究,文献检索面临双重挑战:确保来源真实性的同时,保持对学术搜索意图的深入理解。传统的以关键词为中心的搜索虽然可靠,但无法捕捉复杂的研究意图。前沿大语言模型能够处理复杂研究意图,但高昂的成本和易产生幻觉的倾向仍是关键限制。本文介绍 PaSaMaster,一个自演化智能文献检索系统,通过迭代意图分析、检索和排序,生成带有基于证据推荐的相关性评分论文排名。它基于三个关键设计。首先,它将文献检索从一次性的查询-文档匹配问题转变为随时间演化的搜索过程,利用排序后的证据揭示差距、优化意图并指导后续搜索。其次,它通过将检索视为意图-论文相关性排序而非生成,来防止幻觉来源。最后,PaSaMaster 通过将规划与检索分离来提高成本效率:前沿大语言模型仅用于意图理解,而大规模检索和相关性评分则委托给定制语料库和轻量级模型。在涵盖38个科学学科的 PaSaMaster Benchmark 上评估,我们的系统揭示了传统关键词检索的严重不准确和不完整性(F1分数提升15.6倍)以及生成式大语言模型的不可靠性(幻觉率高达37.79%)。值得注意的是,PaSaMaster 仅以1%的计算成本就比GPT-5.2提升了30.0%,同时保证零来源幻觉:https://github.com/sjtu-sai-agents/PaSaMaster
查看原文
查看缓存全文

缓存时间: 2026/05/15 04:24

论文页面 - 迈向自我演化的智能文献检索

来源:https://huggingface.co/papers/2605.14306 作者:

, , , , , , , , ,

摘要

PaSaMaster 是一个自我演化的智能文献检索系统,通过迭代意图分析和基于证据的排序,提升学术搜索的准确性和成本效率。

随着大语言模型 (https://huggingface.co/papers?q=large%20language%20models) 重塑科学研究,文献检索 (https://huggingface.co/papers?q=literature%20retrieval) 面临双重挑战:确保来源真实性的同时深度理解学术搜索意图。传统的基于关键词的搜索虽然可靠,但难以捕捉复杂的研究意图。前沿的大语言模型可以处理复杂的研究意图,但高成本和易产生幻觉的倾向仍是关键限制。本文介绍了 PaSaMaster,一个自我演化的智能文献检索 (https://huggingface.co/papers?q=literature%20retrieval) 系统,它通过迭代的意图分析 (https://huggingface.co/papers?q=intent%20analysis)、检索和排序,生成带有相关性分数的论文排名和基于证据的推荐 (https://huggingface.co/papers?q=evidence-grounded%20recommendations)。该系统基于三个关键设计。首先,它将文献检索 (https://huggingface.co/papers?q=literature%20retrieval) 从一次性查询-文档匹配问题转变为随时间演化的搜索过程 (https://huggingface.co/papers?q=search%20process),利用排序后的证据揭示差距、细化意图并指导后续搜索。其次,通过将检索视为意图-论文相关性排名 (https://huggingface.co/papers?q=relevance%20ranking) 而非生成,避免了来源幻觉。最后,PaSaMaster 通过将规划与检索分离来提高成本效率:前沿大语言模型仅用于意图理解,而大规模检索和相关性评分则委托给定制语料库和轻量级模型。在涵盖 38 个科学学科的 PaSaMaster 基准 (https://huggingface.co/papers?q=PaSaMaster%20Benchmark) 上进行评估,我们的系统揭示了传统关键词检索的严重不准确性和不完整性(F1 分数提升 15.6 倍)以及生成式大语言模型的不可靠性(其幻觉 (https://huggingface.co/papers?q=hallucination) 率高达 37.79%)。值得注意的是,PaSaMaster 在仅使用 GPT-5.2 1% 计算成本 (https://huggingface.co/papers?q=computational%20cost) 的情况下,性能提升 30.0%,并确保零来源幻觉 (https://huggingface.co/papers?q=hallucination):https://github.com/sjtu-sai-agents/PaSaMaster

查看 arXiv 页面 (https://arxiv.org/abs/2605.14306)查看 PDF (https://arxiv.org/pdf/2605.14306)GitHub1 (https://github.com/sjtu-sai-agents/PaSaMaster)添加到收藏 (https://huggingface.co/login?next=%2Fpapers%2F2605.14306)

在你的智能体中获取这篇论文:

hf papers read 2605.14306

没有最新的 CLI?curl -LsSf https://hf.co/cli/install.sh | bash

引用此论文的模型0

没有模型链接此论文

请在模型 README.md 中引用 arxiv.org/abs/2605.14306 以从此页面链接。

引用此论文的数据集0

没有数据集链接此论文

请在数据集 README.md 中引用 arxiv.org/abs/2605.14306 以从此页面链接。

引用此论文的 Spaces0

没有 Space 链接此论文

请在 Space README.md 中引用 arxiv.org/abs/2605.14306 以从此页面链接。

包含此论文的收藏0

没有收藏包含此论文

请将此论文添加到收藏 (https://huggingface.co/new-collection) 以从此页面链接。

相似文章

基于工作流归纳的多轮自主式科学文献搜索

arXiv cs.CL

本文介绍了PaperPilot,一个多轮文献搜索智能体,它构建可执行的有向无环图(DAG)搜索操作,并通过用户反馈优化工作流,在检索指标上相比基线模型取得了显著提升。

Consensus 用 GPT-5 和 Responses API 加速研究

OpenAI Blog

# Consensus 使用 GPT-5 和 Responses API 在几分钟内完成数周的研究 来源:[https://openai.com/index/consensus/](https://openai.com/index/consensus/) 每年都有数百万篇新的科学论文发表——远远超过任何一个人能阅读的数量。对于科学家来说,挑战不在于获取知识的途径,而在于寻找、解释和关联信息的繁重任务。突破发生在已知领域的边界,然而研究人员大部分时间都在寻找