@ando_w: 今天面试了个候选人,简历写"精通 RAG"。 我问召回率多少,他说"挺好的"。我问怎么评估的,他说"问了几句感觉不错"。 这就是行业现状:90% 的 RAG 项目没有评估集,全靠手感。能说出 Recall 和 Precision 的,已经…

X AI KOLs Timeline 新闻

摘要

一位面试官吐槽自称“精通RAG”的候选人无法说出召回率和精确度,指出行业中90%的RAG项目缺乏规范的评估集,全靠主观判断。

今天面试了个候选人,简历写"精通 RAG"。 我问召回率多少,他说"挺好的"。我问怎么评估的,他说"问了几句感觉不错"。 这就是行业现状:90% 的 RAG 项目没有评估集,全靠手感。能说出 Recall 和 Precision 的,已经是前 10%。
查看原文
查看缓存全文

缓存时间: 2026/07/09 09:40

今天面试了个候选人,简历写“精通 RAG“。

我问召回率多少,他说“挺好的“。我问怎么评估的,他说“问了几句感觉不错“。

这就是行业现状:90% 的 RAG 项目没有评估集,全靠手感。能说出 Recall 和 Precision 的,已经是前 10%。

相似文章

@sitinme: Github 30k star,不用向量数据库也能做 RAG,而且准确率还更高! 做 RAG 的人应该都有过这种体验:向量数据库返回的内容“看起来相关”,但就是不是你要的那个答案。 特别是处理合同、财报、技术手册这类长文档的时候,你问“第…

X AI KOLs Timeline

介绍一个GitHub上30k star的开源项目,通过推理而非向量数据库实现RAG,号称准确率更高,解决了向量检索中相似不等于相关的问题。