我正在构建一个公开发布自身幻觉率的搜索引擎。这真的有用还是只是个噱头?
摘要
作者正在构建CLYCITE——一个将答案扎根于实时检索来源、提供引用并按类别公开发布其准确率的搜索引擎。他们向社区征求反馈,以了解公开的准确率仪表盘和无广告订阅模式是否具有价值。
当前AI搜索引擎的准确性正在变得越来越差,而非更好。Perplexity的幻觉率从2024年8月到2025年8月几乎翻倍,从18%升至35%。Google的AI概览正在被出版商起诉。没有人诚实地公开他们出错的频率。因此,我正在构建CLYCITE,一个搜索引擎,每个答案都基于实时检索的来源,每个声明都有引用,并且我们按类别公开发布自己的准确率。如果我们在医疗查询上有12%的错误率,你可以看到。没有其他引擎这样做。除此之外,愿景是添加智能体,在你获得答案后帮助你更深入地验证特定声明、比较5个来源的实际说法、监控某个话题的变化。不是自主智能体替你做事,而是展示其工作步骤的智能体。向本社区提出的诚实问题:1. 公开的准确率仪表盘是否会真正改变你对搜索引擎的信任方式,还是你会忽略它?2. 你愿意每月支付12美元使用一个每项回答都提供引用且永不显示广告的搜索引擎吗?3. 对你来说,2026年‘比Google更好’到底意味着什么?4. 什么会让你从Perplexity或ChatGPT切换过来?我不是来推销的。我来这里是因为这个社区会告诉我,我是在解决一个真正的问题,还是在构建一个没人需要的东西。请直言不讳。
相似文章
我用10美元在周末为创客建了一个50万域名的搜索引擎
一位开发者描述了他如何用10美元在周末构建了一个个人搜索引擎,索引了56万个主页,并使用租用的GPU和小型本地语言模型来总结网站。
有源可查,否则未曾发生:一种用于检测引用幻觉的多智能体框架
本文介绍了 CiteTracer,这是一个用于检测大语言模型(LLM)生成的科学写作中引用幻觉的多智能体框架,在合成和真实世界基准上均实现了高精度。
网站在谷歌排名靠前,但在AI概览或LLM中几乎不出现。我忽略了什么?
一位网站所有者讨论了一个挑战:尽管在谷歌排名强劲,但在AI概览以及ChatGPT、Gemini等LLM中难以获得可见性,并询问提升引用率的实用策略和工具。
构建一个为AI代理和爬虫提供干净HTML的代理服务:寻求反馈(不推广)
作者正在寻求关于一个自助代理服务的反馈,该服务旨在通过提供干净的HTML、动态添加元标签和提供分析来增强SEO和AI代理的可读性。
AI搜索的定价简直就是个骗局...
作者创建了一个开源工具,为AI代理提供无限次免费网络搜索,批评现有AI搜索提供商定价过高。该工具可在 laurel.dev 获取。