我制作了一个小工具,用于在将检索结果输入RAG之前进行检查
摘要
一位开发者创建了一个小型本地工具,用于在将检索结果输入RAG流水线之前,检查来自Brave、Serper、Tavily和Exa等搜索提供商的检索结果,并关注源多样性、重复性、时效性以及SEO/GEO污染风险等信号。
我一直在尝试RAG的实时网页检索,而一直让我烦恼的部分并不是搜索调用本身,而是判断返回的结果是否真的能用作证据。一个结果可能看起来相关,但仍然可能过时、重复、过度SEO优化,或者根本不足以放入上下文窗口。所以我整理了一个小型本地工具,用于在将检索/搜索结果输入RAG流水线之前进行检查:[https://github.com/mameirolabs/rag-search-quality-lab-public](https://github.com/mameirolabs/rag-search-quality-lab-public) 目前它支持mock、Brave、Serper、Tavily和Exa。它关注一些粗略的信号,如源多样性、重复性、时效性、引用就绪度、SEO/GEO污染风险以及提供商差异。我并不是想做一个基准测试或宣布哪个提供商“最好”。评分仍然非常粗略。我主要用它来并排比较输出,并在证据到达模型之前发现不良证据。很好奇其他人是如何处理这个问题的:在RAG流水线中信任检索到的网页结果之前,你会检查哪些信号?
相似文章
哪种网络搜索API能为本地RAG解析提供最干净的Markdown输出?
针对为本地RAG管线提供干净Markdown输出的需求,本文比较了多种网络搜索API与工具(包括Brave Search、Parallel AI、You.com、Exa、Tavily、Firecrawl、Jina Reader以及SearXNG),评估它们在信噪比和开发者开销方面的表现。
@h100envy:这篇论文彻底改变了我对 RAG 中信任检索的看法:获取文档 -> 评估质量 -> 得…
本文提出了一种5步蓝图,通过使用轻量级检索评估器来提高 RAG 中的信任度。该评估器对文档质量进行评分,并触发(正确、错误、模糊)三种动作来处理检索失败,具有即插即用的集成特性。
在应用场景中评估RAG指标:一项实验、发现与局限性
本文通过一项实证研究,比较了来自四个库(Ragas、DeepEval、RAGChecker、Opik)的RAG评估指标与人工判断及标准召回指标,并基于商业数据创建了问答数据集。
@GYLQ520: PixelRAG 来自伯克利 SkyLab 等团队,开源可玩。 它的思路很直接,不再靠 HTML 或文本解析,而是把网页、PDF 直接截成截图,用视觉索引做 RAG 检索。 表格、图表、布局这些 HTML 解析会丢掉的东西,全保留下来了。…
PixelRAG 是来自伯克利SkyLab等团队的开源项目,通过将网页和PDF截图为截图并用视觉索引进行检索,提高RAG准确率并显著降低AI Agent的token成本。
@akshay_pachaar: 网页抓取将彻底改变。(100%开源的大规模视觉搜索) PixelRAG是一种检索系统,可跳过…
PixelRAG是一种开源检索系统,它通过截取网页截图并使用视觉语言模型直接从像素中读取答案,从而绕过HTML解析,声称相比基于文本的RAG有显著的准确率提升。