我构建了一个代理,用于记录你的智能体实际执行的所有操作
摘要
我构建了Trovis,一个能够记录并解释生产环境中智能体操作的工具,展示与预期行为的偏差。
我在生产环境中运行智能体。一直遇到同样的问题:不知道它们实际在做什么。日志散落得到处都是。如果某个智能体偏离了预期行为,你发现得也太晚了——通常是从客户那里得知的。所以我构建了Trovis。它记录你的智能体执行的每一个操作,并用简洁的英文呈现出来。每个操作都带有时间戳并归属于相应智能体;显示智能体应该做什么与实际做了什么之间的对比。你不会看到原始的遥测数据,而是看到像“你的支持智能体今天处理了40个任务,偏离范围两次”这样的信息。目前运行在OpenClaw上。欢迎提问。
相似文章
一个记录你的OpenClaw智能体实际所做一切的插件
Trovis 是 OpenClaw 的插件,记录所有智能体的行动、成本及偏差,并以通俗易懂的英语呈现,提升可观测性。
需要直率反馈:我构建了一个用于记录AI代理运行的工具
一位开发者构建了agentproof-recorder来记录AI代理运行并检测规则违规,寻求反馈这是否是一个常见的痛点。
我开源了一个完整的代理可观测性堆栈:记录 -> 检查 -> 差异 -> 行动(全部MIT)
本文介绍了一个开源的代理可观测性堆栈,包含四个MIT许可的仓库,专注于提取和检查模型信念,以提升AI代理的调试和性能。
你的智能体在做什么?
我们构建了一个开源的回顾性读取器,用于Claude Code,以分析智能体行为,利用真实的执行历史来指导运行时治理。
一种构建自动化的新型智能体方法
一种新工具允许用户屏幕录制自己执行任务;智能体学习该任务并构建确定性脚本以自动化执行,并在脚本出错时进行回退处理。