Sponsio:面向LLM Agent的确定性合约层 [P]
摘要
Sponsio是一个开源确定性合约层,用于强制执行LLM Agent的工具调用边界和规则,解决了提示工程和事后审计无法完全解决的生产可靠性问题。
我们一直在尝试将LangGraph Agent投入生产。一直困扰我们的是工具调用边界的强制问题:例如“必须在Y之前调用X”、“最多重试N次”、“在执行破坏性操作前需审批门控”。演示时一切正常,但在关键时刻却出了问题。我们首先尝试了提示工程:告诉模型“始终在 `issue_refund` 之前调用 `check_policy`”。大约95%的情况下有效。但剩下的5%正是审计人员会过问的情况。当有人想知道为什么退款通过时,这可不是一个好答案。事后审计(OTEL + 日志)能在事后发现违规,但副作用已经发生。为退款退款很尴尬。将所有逻辑整合到工作流引擎中(Temporal,或最近的nano-vm)提供了强保证,但需要针对其运行时重写Agent,对我们来说成本太高。最终我们采用的方法:在工具边界处使用合约层。YAML规则,确定性评估,在工具调用提交前执行。已开源为Sponsio。仓库:[github.com/SponsioLabs/Sponsio](http://github.com/SponsioLabs/Sponsio) 欢迎任何在生产环境中运行Agent的人提供反馈。
相似文章
在遭遇多次'合法但错误'的失败后,我为工具边界构建了一个确定性执行层
作者描述了构建 Sponsio 的过程,这是一个面向 LLM 代理的开源确定性执行层,通过使用时间逻辑的 YAML 合约评估工具调用来防止'合法但错误'的行为,弥补了提示工程中的一个缺口。
从提示到契约:面向可审计企业级LLM代理的约束工程
介绍了一种约束工程方法,用于构建可审计的企业级LLM代理,通过将确定性行为转移到代码、模式和验证工件中,并在韩国企业数据上通过故障注入和模型替换测试进行了演示。
Contract2Tool:学习前提与效果以实现可靠的工具增强型LLM代理
本文介绍了Contract2Tool,一个从工具元数据、文档和执行轨迹中自动推断轻量级工具契约(前提条件、效果、风险)的框架,为LLM代理实现可靠的因果工具过滤。实验表明,学习到的契约在下游多步骤代理任务中达到了接近黄金契约的性能,同时显著减少了token使用量。
层隔离评估:基于无LLM、回归锁定的测试框架对生产级LLM代理的确定性骨架进行门控
本文介绍了针对LLM代理的层隔离评估方法,将生产级代理分解为架构层,每层使用确定性无LLM测试框架进行测试。它展示了逐切片基线测试能够定位聚合指标所掩盖的性能回归,并通过跨多个租户的受控回归注入进行了验证。
迈向可安全审计的大模型智能体:一种统一的图表示方法
本文提出了 Agent-BOM,一种用于基于大语言模型(LLM)的智能体系统进行安全审计的统一图表示方法。它通过建模静态能力和动态运行时状态,解决了事后审计中的语义鸿沟问题,能够检测记忆投毒和工具误用等复杂的攻击链。