代理平台,其中代理无法伪造数字——数字来自编译器

Reddit r/AI_Agents 工具

摘要

一个AI代理平台,代理从受控的语义模型中选择,编译器处理计算以防止数字伪造,确保业务用例的数据准确性。

大多数代理框架让大语言模型编写SQL并报告结果。这没问题,直到它错误地聚合某些内容并自信地陈述,这对业务数据来说比失败更糟。我决定的分工是:模型选择,编译器计算。对于任何涉及数据的操作,代理从受控的语义模型中选择——仅限于声明的指标和维度名称,没有其他。它从不查看你的表或列,也从不编写SQL。编译器将其选择转化为语句,并拒绝任何会返回虚高数字的内容。如果代理命名了一个不存在的指标,它会被拒绝并给出原因,而不是悄悄替换为类似的东西。在我今天发布的演示文稿导出中同样适用此原则:AI撰写幻灯片标题和要点,所有数字均来自仪表板自身的数据。如果它在文本中混入一个计算出的数字——比如增长率、总数——那个句子会在到达幻灯片之前被移除。即使你明确要求百分比,它也坚持这一原则,有些人可能会觉得烦,但我认为这是正确的做法。平台的其他功能:可视化多代理画布、人工审批节点、子群、A2A和MCP双向支持、每个代理的预算,以及在调用前强制执行的模型规则。自托管、源代码可用、使用你自己的模型密钥。
查看原文

相似文章

我们如何尽可能让AI增长代理值得信赖

Reddit r/AI_Agents

作者描述了如何通过确定性代码、事实集验证和限定范围的数字匹配,而不是依赖提示规则,来让他们的AI增长代理Alice值得信赖。他们为任何需要向用户报告数字的代理分享了实用经验。

Agentspan

Product Hunt

Agentspan 是一个用于构建持久性AI代理的开源运行时。

智能体市场

Reddit r/AI_Agents

讨论了在将AI智能体投入生产时尚未解决的关键问题,并探索了智能体市场的构想——即通过标准化的输入输出和共享评估体系,将离散的工作单元进行交易。