@antirez: 我一直在思考向量集(Vector Sets)以及 Redis 对此类问题的整体处理方式。既然 RAG 的热潮已过,我…
摘要
Salvatore Sanfilippo 回顾了他早前的预测:RAG 会逐渐消退,而原始向量搜索仍有价值,如今 RAG 的热潮已经消退。
我一直在思考向量集(Vector Sets)以及 Redis 对此类问题的整体处理方式。既然 RAG 的热潮已过,我百分之百确定我当时的判断是正确的:RAG 大多会消失,但原始向量搜索是一种有用、基础且强大的数据结构。
相似文章
@HowToPrompt__:整个向量数据库行业被一个1974年的免费工具打败了。过去两年里,每一家公司……
研究人员报告称,经典的grep命令在自主AI代理的检索任务中胜过现代向量数据库,挑战了当前主流的RAG基础设施方法。
@Al_Grigor: 不要默认从一开始就在RAG项目中使用向量搜索。先使用文本搜索。更简单:- 无需嵌入模型 ……
一条实用建议的推文,建议从一开始就用文本搜索(BM25)而不是默认用向量搜索来启动RAG项目,以降低复杂性;只有出现语义差距时才添加向量搜索。
@shedntcare_: 突发:阿里巴巴刚刚发布了一个可能永远改变RAG的向量数据库。认识Zvec 无需服务器。无需Docker。无需云…
阿里巴巴发布了Zvec,一个完全开源的向量数据库(Apache 2.0),可通过pip安装,支持针对RAG应用的稠密、稀疏和混合搜索,能在毫秒内处理数十亿向量。
@thesupermanmx: Google DeepMind 认为 RAG 已经失效。他们发表了一篇论文,证明向量数据库是死胡同。对于过去…
Google DeepMind 的一篇论文认为,RAG 系统中的单向量嵌入存在严格的数学极限,证明向量数据库无法完全捕捉复杂的文档关系。他们引入了 LIMIT 压力测试数据集,以展示最先进的模型在结构化查询上也会失败。
@N01ennn: 微软将其图系统与向量RAG在8k、120k和完整百万token上下文窗口上对比,百万……
微软研究院的LazyGraphRAG在8k、120k和百万token上下文的数据本地问题上超越了向量RAG,以十分之一的成本赢下92/90/91%的胜率,现已在GitHub上开源。