我正在为AI代理构建一个信念数据库。这是一个原型——你有真实数据集可以测试吗?

Reddit r/AI_Agents 工具

摘要

Verus 是一个为AI代理设计的开源信念数据库,能够追踪来自多个来源的冲突声明,并附带置信度评分和冲突检测功能;作者正在寻找真实世界的数据集和反馈。

大家好,我正在构建 **Verus** —— 一个为AI代理设计的开源信念数据库。核心理念是:传统数据库存储事实:`user.city = 'Lisbon'`,而 Verus 存储的是 **声明** —— 关于同一事物的多个断言来自不同来源,每个都带有置信度评分、有效期以及冲突检测。它帮助代理决定 **该相信什么**。示例:4个来源对用户位置给出了4种不同说法(CRM显示纽约,用户说里斯本,IP地理位置显示伦敦,日历显示东京)。Verus 追踪全部四个来源及其置信度和有效期,检测矛盾,并通过策略驱动的解决方案将其暴露给代理。原型展示了: * 冲突图 —— 节点是声明,边是它们之间的矛盾 * 随时间视觉衰减的置信度评分 * 来源过滤(CRM、用户输入、API、文档、代理推理) * 带有有效窗口的声明时间线 **技术栈:** Rust 核心(二进制存储,单个文件,零依赖)+ MCP 服务器(与 Claude Code、Cursor、VS Code、Windsurf 兼容)+ 用于可视化的 Web 界面。 **我所寻求的:** 我已经用合成数据(24个声明,9个冲突,来自5个来源)构建了这个原型。在进一步深入之前,我想用真实场景进行验证: 1. **你是否有来自多个来源的冲突信息数据集**,我可以用作测试? 2. **你目前在代理中处理冲突数据的方法是什么?** 硬编码规则?LLM 提示?还是其他方法? 3. **你最常遇到的冲突类型是什么** —— 矛盾、数据过时、来源可靠性问题? 对这个概念或原型的任何反馈也都很受欢迎。谢谢!
查看原文

相似文章