vector-search

标签

Cards List
#vector-search

智能体的记忆尚未成熟

Reddit r/AI_Agents ↗ · 2026-05-30

对当前AI智能体记忆解决方案的批评,认为RAG包装器及类似方法未能解决模型偏见和上下文膨胀的核心问题。

0 人收藏 0 人点赞
#vector-search

比较向量搜索库

Reddit r/LocalLLaMA ↗ · 2026-05-29

对向量搜索库(Faiss、Scann、Usearch)进行基准测试,涵盖从500到100万样本的数据集大小,评估速度、内存使用和精确度,并提供结果和代码。

0 人收藏 0 人点赞
#vector-search

@arizeai: 我们的开发者关系主管 Laurie Voss 将在 QDrant 的 Vector Space Day 大会上发表演讲!大多数团队……

X AI KOLs Following ↗ · 2026-05-22 缓存

Arize 的 Laurie Voss 将于6月11日在旧金山举行的 QDrant Vector Space Day 大会上发表演讲,内容涵盖检索指标、黄金数据集、LLM-as-judge 以及用于 CI 管线的持续评估。

0 人收藏 0 人点赞
#vector-search

@Al_Grigor: 不要默认从一开始就在RAG项目中使用向量搜索。先使用文本搜索。更简单:- 无需嵌入模型 ……

X AI KOLs Timeline ↗ · 2026-05-22 缓存

一条实用建议的推文,建议从一开始就用文本搜索(BM25)而不是默认用向量搜索来启动RAG项目,以降低复杂性;只有出现语义差距时才添加向量搜索。

0 人收藏 0 人点赞
#vector-search

DIVE:通过自限制梯度更新的嵌入压缩

arXiv cs.CL ↗ · 2026-05-21 缓存

提出DIVE,一种用于嵌入维度缩减的压缩适配器,采用自限制梯度更新和头部级NT-Xent对比损失,防止在小数据集上过拟合,在BEIR基准测试上优于现有方法。

0 人收藏 0 人点赞
#vector-search

@nash_su: llm_wiki v0.4.11 版本更新发布,Star数也突破了8k 本次更新主要功能: - 新增本地 API Server,可通过接口访问项目文件、搜索、关系图数据和资料重扫,可在设置中配置,配合 Skill,可以接入各种 Agent…

X AI KOLs Timeline ↗ · 2026-05-19 缓存

llm_wiki v0.4.11 发布,新增本地 API Server 支持 Agent 接入,统一搜索后端,知识图谱新增搜索功能,Star 数突破 8k。

0 人收藏 0 人点赞
#vector-search

@jerryjliu0:真正的问题是:文件搜索和检索的最新实际技术水平是什么?- 在文件系统上实际使用 grep…

X AI KOLs Following ↗ · 2026-05-18 缓存

Jerry Liu 询问文件搜索和检索的当前最先进技术,列出了从 grep 到数据库上的混合搜索等选项。

0 人收藏 0 人点赞
#vector-search

为什么向量RAG在大规模AI编程代理中失败(以及我如何使用Neo4j图来解决它)

Reddit r/ArtificialInteligence ↗ · 2026-05-18

一款名为Writ的新开源工具采用混合检索流程,结合BM25、本地ONNX向量和Neo4j图遍历,为AI编程代理提供上下文规则,将令牌膨胀减少726倍,并通过bash钩子强制计划审批。

0 人收藏 0 人点赞
#vector-search

@jerryjliu0:关于grep是否是智能体搜索所需的全部工具,这个问题尚无定论。@PwCUS(Sen等人)最近的这篇论文似乎……

X AI KOLs Following ↗ · 2026-05-17 缓存

最近的一篇论文研究了在智能体检索中,grep是否优于向量搜索,发现grep在对话记忆测试中具有更高的准确性,但也指出了在企业文档语料库方面的局限性。

0 人收藏 0 人点赞
#vector-search

@dair_ai:关于自主搜索与向量搜索的精彩论文。

X AI KOLs Following ↗ · 2026-05-15

本文讨论并比较了自主搜索与向量搜索方法。

0 人收藏 0 人点赞
#vector-search

@JinaAI_: jina-embeddings-v5-omni 正式发布!我们首个支持文本、图像、音频和视频的通用嵌入模型。现已在 t…

X AI KOLs Timeline ↗ · 2026-05-12

Jina AI 发布了 jina-embeddings-v5-omni,这是一款支持文本、图像、音频和视频的通用嵌入模型,具备向后兼容的索引功能。

0 人收藏 0 人点赞
#vector-search

Show HN: 学术论文版 TikTok

Hacker News Top ↗ · 2026-05-11 缓存

Papel 是一个以研究为导向的新型社交平台,利用 AI 驱动的向量搜索和设备端 RAG,帮助研究人员发现、讨论学术论文并进行自我测验。它提供个性化信息流、通过 Apple Intelligence 或 MLX 进行本地 AI 聊天,以及游戏化学习功能。

0 人收藏 0 人点赞
#vector-search

@tech_with_ram:你的 AI 技术栈有个数据库问题 你需要一个向量数据库来存嵌入。一个图数据库来处理关系。一个应用 …

X AI KOLs Timeline ↗ · 2026-05-11

HelixDB 是一款新的开源数据库,采用 Rust 构建,将向量、图和其他数据模型结合到单一引擎中,由 Y Combinator 支持。它旨在取代 AI 技术栈中独立的向量、图和应用数据库,提供原生向量搜索、图遍历和 MCP 支持。

0 人收藏 0 人点赞
#vector-search

@akshay_pachaar: 朴素 RAG vs. Blockify!一种全新的 RAG 方案:- 语料库体积缩减 40 倍 - 每次查询 token 用量减少 3 倍 -…

X AI KOLs Following ↗ · 2026-05-09 缓存

Blockify 是一个新的开源 RAG 框架,以专利技术「IdeaBlocks」流水线取代传统分块方式,声称可实现语料库体积缩减 40 倍、token 使用效率提升 3 倍、向量搜索准确率提升 2.3 倍。它将企业文档转化为结构化 XML 知识单元,以实现更连贯的 LLM 检索效果。

0 人收藏 0 人点赞
#vector-search

@lateinteraction: 主题演讲录像现已上传至 YouTube,供所有要求我们在 X 平台以外托管的用户观看。https://youtube.com/watch?v=Z2…

X AI KOLs Timeline ↗ · 2026-04-13 缓存

一场主题演讲认为,后期交互检索(如 ColBERT 风格)是 AI 规模信息检索研究中最具前景的方向,并指出单向量密集检索存在根本性缺陷,呼吁信息检索社区大幅提升研究雄心。演讲引入 LIMIT 基准测试,作为密集检索泛化能力不足的佐证,并呼吁在 2030 年前实现范式转变。

0 人收藏 0 人点赞
#vector-search

RyanCodrai/turbovec

GitHub Trending (daily) ↗ · 2026-06-08 缓存

turbovec 是一个基于 Rust 的向量索引,带有 Python 绑定,实现了谷歌的 TurboQuant 算法,提供高效的向量搜索,支持在线摄入,性能优于 FAISS,并具备过滤搜索能力。

0 人收藏 0 人点赞
← Previous
← 返回首页

提交意见反馈