@Marco_Ramilli: PageIndex 32,751 星 放弃向量数据库,停止分块。构建基于推理的 RAG,实现上下文感知、类人的……
摘要
PageIndex 是一个开源的、基于推理的 RAG 系统,它用层级树索引和 LLM 驱动的检索取代了向量数据库和分块,用于上下文感知、类人的文档理解。
查看缓存全文
缓存时间: 2026/06/08 23:34
基于推理的RAG ◦ 无向量数据库,无分块 ◦ 上下文感知检索 ◦ 类人
🌐 网站 • 🖥️ 聊天平台 • 🔌 MCP & API • 📖 文档 • 💬 Discord • ✉️ 联系方式
📢 更新
相似文章
@0x0SojalSec:无向量、基于推理的RAG的文档索引——无需向量数据库构建RAG。该开源库使用文档树...
PageIndex 是一个用于无向量、基于推理的RAG的开源库,它使用层次化文档树而非嵌入向量,在FinanceBench上达到了98.7%的准确率。它无需向量数据库或分块即可实现上下文感知检索。
VectifyAI/PageIndex
PageIndex 是一款用于创建文档索引的工具,支持基于推理、无需向量数据库的检索增强生成(RAG)。
@cevenif: 传统 RAG 的玩法正在被一个叫 PageIndex 的工具直接掀翻。它不用向量数据库、不用嵌入、不用切块,连相似搜索都省了,而是直接给文档建树形索引,让 LLM 像人一样逐层往下推。 在 FinanceBench 上,它跑出了 98.7…
PageIndex 是一个开源工具,通过构建文档的树形索引,无需向量数据库和嵌入,实现高效的 LLM 检索。在 FinanceBench 上达到 98.7% 的准确率。
关于本地文档RAG系统的帮助(存储 + 摄取 + 查询 + 高亮)
一个关于构建本地文档RAG系统的详细技术咨询,涵盖存储、摄取、查询和高亮,寻求关于向量数据库、GraphRAG可行性以及文档高亮实现的建议。
@vintcessun: RAG喂太多文档,检索质量反而从75%掉到40%?向量搜索被大量无关内容稀释,真实部署中命中率暴跌。 问题根源:异构文档混在一起检索,噪声淹没了信号。多智能体编排看似智能,实际引入精度-忠实度悖论——配置稍差就两头不讨好。 论文提出的MA…
This paper identifies 'vector search dilution' in RAG systems when scaling to large heterogeneous document collections, where accuracy dropped from 75% to 40% in a real-world deployment. The proposed MASDR-RAG method uses domain scoping via organizational metadata before retrieval, improving P@10 from 0.77 to 0.86 with low cost and easy deployment.