@seclink: 冷知识,RAG 技术的演进路径 ① 2020 — 基础 RAG(解决"知识不在模型里") 起点是 Lewis 等人的 RAG:DPR 稠密检索 + 向量相似度 + 生成。它第一次让 LLM 能"外接知识库",缓解幻觉和时效性问题。但这代是…
摘要
科普了RAG技术从2020年基础RAG到2025-2026年自主智能体+强化学习的演进路径,涵盖检索精度提升、反思纠偏、图谱增强、路由优化与Agentic RAG等方向,并总结了各阶段代表性工作与痛点。
查看缓存全文
缓存时间: 2026/08/07 14:52
冷知识,RAG 技术的演进路径 ① 2020 — 基础 RAG(解决“知识不在模型里“) 起点是 Lewis 等人的 RAG:DPR 稠密检索 + 向量相似度 + 生成。它第一次让 LLM 能“外接知识库“,缓解幻觉和时效性问题。但这代是“无脑检索“——先把所有文本切成 chunk 做向量索引,查询时取 top-k 就完事。痛点:chunk 彼此孤立、检索粗糙、对复杂问题无力。这正是所有分支要解决的问题。
② 2022–2023 — 检索精度升级(更准)
ColBERTv2:把“单向量“改成 token 级多向量 + MaxSim 延迟交互,匹配更细;残差压缩把存储降 6–10 倍。检索器本身从“粗“变“准“。 Modular RAG:意识到 RAG 不该是固定管道,而是一堆可编排模块(检索/重排/生成),像乐高一样组合。架构开始“模块化“。 ③ 2023–2024 — 反思纠偏 + 结构增强(更准、更懂关系)
Self-RAG / CRAG:给系统装“质检员“——Self-RAG 用反思 token 自己决定要不要检索、内容对不对;CRAG 用轻量评估器三路径纠正(正确用/错误重写或联网/模糊混合)。解决了“检索到垃圾也不知道“的问题。 RAPTOR:用递归摘要树组织文档,适合全局性、多跳、总结类问题。 GraphRAG / LightRAG / HippoRAG2:把文本抽成实体–关系知识图谱,用图谱做多跳推理(Microsoft GraphRAG 用 Leiden 社区摘要;HippoRAG 用个性化 PageRank)。这是“结构化知识“路线,但全量图谱构建很贵。 ④ 2024–2025 — 路由与成本优化(更省)
Adaptive RAG:按查询复杂度动态路由——简单问题直接 LLM 答、复杂问题才走多步检索。 LazyGraphRAG:把社区摘要延迟到查询时才算,索引成本降到 GraphRAG 的 0.1%。 长上下文路由:2M token 窗口出现后,结论是“不替代 RAG,而是分工“——简单查走 RAG(几分钱),复杂多跳走长上下文,视觉文档走 ColPali。GraphRAG-Bench(ICLR 2026)给出经验法则:图的价值随查询复杂度上升。 ⑤ 2025–2026 — 自主智能体 + 强化学习(更自主)
Agentic RAG:让 AI agent 动态决定“用什么工具(向量库/网页/API/SQL)、查几轮、怎么合成“。 Search-R1 / DeepRetrieval / DeepResearcher / MCTS-RAG:用 RL 端到端训练 LLM 学会“何时搜、搜什么“。Search-R1 在 Qwen2.5-7B 上比普通 RAG 提升 41%;DeepRetrieval 直接以检索指标(recall@k、NDCG)为奖励优化查询;MCTS-RAG 把蒙特卡洛树搜索融进推理。这是从“固定流程“走向“会自己找信息的智能体“。
相似文章
@ando_w: https://x.com/ando_w/status/2075468963098546520
本文介绍如何将单轮RAG升级为Agentic RAG,通过让LLM自主决定多次检索和调用工具,解决复合问题的多步推理。提供了基于Qwen3.7-Max的代码示例和实现思路。
@TheTuringPost:2026年需了解的20种高级RAG类型 - 思维场景感知RAG (MiA-RAG)、基于超图记忆的多步RAG (HGMem)……
本文概述了预计在2026年具有相关性的20种高级RAG(检索增强生成)类型,涵盖长文档记忆、自适应检索、多模态接地、多语言问答、图推理以及安全导向的RAG方法。
@freeman1266: 普通 RAG vs 知识图谱 RAG vs LLM Wiki——三种知识库检索方案,95% 的人选错了,不是因为不懂,是因为没认清自己的数据形态。 三句话讲清楚: 普通 RAG:把文档切成 chunk,向量化入库,问题来了找相似片段喂给 …
本文对比了普通RAG、知识图谱RAG和LLM Wiki三种知识库检索方案的适用场景与选型建议,强调根据数据形态选择正确方案,避免盲目使用复杂工具。
@XiaohuiAI666: 你的 RAG 实现方法是错误的! 传统 chunk 缺乏知识边界、版本信息和元数据,导致检索上下文缺失、版本混杂、权限控制困难。 作者提出的新方法以 IdeaBlock(问题-答案+治理字段)替代 chunk,实现结构化知识单元。 不改检…
作者提出以IdeaBlock(问题-答案+治理字段)替代传统chunk来改进RAG知识单元,已开源Blockify工具,可减少40倍语料、3倍token并提升2.3倍相关性。
RAGA:用于自主知识图谱构建和检索增强生成的阅读与图谱构建智能体
RAGA 是一个由大语言模型驱动的自主智能体,通过“阅读-搜索-验证-构建”的认知循环构建知识图谱,并集成混合符号-向量检索以实现检索增强生成,在科学问答数据集上取得了实验性改进。