代理平台,其中代理无法伪造数字——数字来自编译器
摘要
一个AI代理平台,代理从受控的语义模型中选择,编译器处理计算以防止数字伪造,确保业务用例的数据准确性。
大多数代理框架让大语言模型编写SQL并报告结果。这没问题,直到它错误地聚合某些内容并自信地陈述,这对业务数据来说比失败更糟。我决定的分工是:模型选择,编译器计算。对于任何涉及数据的操作,代理从受控的语义模型中选择——仅限于声明的指标和维度名称,没有其他。它从不查看你的表或列,也从不编写SQL。编译器将其选择转化为语句,并拒绝任何会返回虚高数字的内容。如果代理命名了一个不存在的指标,它会被拒绝并给出原因,而不是悄悄替换为类似的东西。在我今天发布的演示文稿导出中同样适用此原则:AI撰写幻灯片标题和要点,所有数字均来自仪表板自身的数据。如果它在文本中混入一个计算出的数字——比如增长率、总数——那个句子会在到达幻灯片之前被移除。即使你明确要求百分比,它也坚持这一原则,有些人可能会觉得烦,但我认为这是正确的做法。平台的其他功能:可视化多代理画布、人工审批节点、子群、A2A和MCP双向支持、每个代理的预算,以及在调用前强制执行的模型规则。自托管、源代码可用、使用你自己的模型密钥。
相似文章
面向受监管行业的智能体AI的不同方法 - 问题探讨
总结了一种确定性的、基于约束的方法,用于在受监管金融领域构建AI智能体,其中LLM仅生成散文,数字通过加密方式密封,并通过分层结构确保可审计性。
我们如何尽可能让AI增长代理值得信赖
作者描述了如何通过确定性代码、事实集验证和限定范围的数字匹配,而不是依赖提示规则,来让他们的AI增长代理Alice值得信赖。他们为任何需要向用户报告数字的代理分享了实用经验。
Agentspan
Agentspan 是一个用于构建持久性AI代理的开源运行时。
智能体市场
讨论了在将AI智能体投入生产时尚未解决的关键问题,并探索了智能体市场的构想——即通过标准化的输入输出和共享评估体系,将离散的工作单元进行交易。
对于智能体构建者来说,缺失的从来不是框架,而是资本。现在有了一个场所,智能体可以在其中融资、赚钱,并获得推理费用的支付。
Bankr 是一个平台,AI 智能体可以在其中启动、融资、赚取使用费,并获得推理成本补贴,将自己定位为面向智能体原生项目的 VC 融资替代方案。