@garrytan:GBrain 在 LongMemEval 上击败 MemPalace,并且我发布了基准测试和开源评估仓库来证明这一点
摘要
作者声称 GBrain 在 LongMemEval 基准测试中表现优于 MemPalace,并已开源评估仓库以验证结果。
查看缓存全文
缓存时间: 2026/05/08 09:52
GBrain 在 LongMemEval 上击败了 MemPalace
我发布了基准测试和开源评估仓库来证明这一点 https://t.co/UNtSBWMxGa
相似文章
@garrytan: 我的最新gbrain-evals刚刚发布 - 这是gbrain与其他选项的比较。http://ZeroEntropy.dev 在重新排名方面是SOTA…
Garry Tan发布了新的gbrain-evals基准测试,显示ZeroEntropy.dev在重新排名和嵌入成本、速度及检索成功率方面达到SOTA,击败了MemPalace和Vector RAG。
@garrytan: 我刚制作了一些新的GBrain评估,这些评估有助于证明我为AI代理设计的检索开源层在读取记忆方面达到了SOTA水平……
Garry Tan 发布了针对gbrain的新评估。gbrain是一个面向AI代理的开源检索层,展示了在记忆读写方面的最新性能,且无需LLM-in-loop检索。
@discountifu: 原来真有一个叫记忆宫殿的开源项目,号称是目前跑分最强的 AI 记忆系统
介绍了一个名为 MemPalace 的开源 AI 记忆系统,声称在 LongMemEval 上达到 96.6% R@5,采用本地优先、可插拔后端的设计,支持 CLI 和 MCP 服务器部署。
@garrytan: GBrain SkillOpt 现在有4个端到端评估验证其功能 https://github.com/garrytan/gbrain-evals/blob/main/docs/benc…
Garry Tan 的 gbrain-evals 是一个用于 gbrain(AI 代理的长期记忆)的开源测试套件,包含4个端到端评估验证 SkillOpt 功能,在多个基准测试中实现了高召回率和高精确度。
MemPalace/mempalace
MemPalace 是一款本地优先的开源 AI 记忆工具,能够逐字存储对话历史,并通过语义搜索进行检索,在 LongMemEval 上达到 96.6% R@5,无需任何 API 调用或 LLM。它采用可插拔后端架构,提供 CLI 界面,支持 Claude Code、Gemini CLI 以及 MCP 兼容工具。