@rvaniaaaa: 我查看过的几乎每个自我改进智能体都有同样缺失的部分。人们构建了发现部分。Scout 找到…
摘要
一条推文讨论了自我改进智能体缺失的部分:一个严格的审查关卡,要求经验丰富的工程师必须批准每个技能。它解释了不断增长的库如何提高发现和提取质量,由人类批准所有合并以保持系统的可信度。
查看缓存全文
缓存时间: 2026/08/09 03:17
我研究过的几乎每个自我改进型智能体都有着同一个缺失环节。
人们构建发现部分。侦察器搜索代码仓库。过滤器剔除噪音。提取器提取工作流。但然后他们就停了。
大多数讨论在技能生成之后就停止了。
真正决定系统是持续进化还是崩坏的,是审查阶段。只有一个问题:一位经验丰富的工程师会不会不做任何修改就直接安装它?会,还是不会?没有别的。
如果答案是不会,那么这项技能在进入库之前就已经死亡。不会标记为稍后处理。不会标记为改进。直接消失。正是这一道关卡,让库变得越来越强大,而不只是越来越庞大。
更深层的问题是,为什么系统会随着时间推移而变得更好,却无需任何手动重新训练。这不是魔法。这是上下文。更大的库给了发现智能体更丰富的模式可以比对。更丰富的模式产生更高质量的提取。更高质量的提取生成更强的技能。更强的技能提高了通过审查关卡的标准。
这个循环自我喂养。自动化提出建议。人类批准。没有任何东西会自动合并。正是这一条约束让整个系统保持可信。
收藏这条
rvaniaaa (@rvaniaaaa): 有人构建了一个能自己学习新技能的AI智能体。唯一的人工步骤是最终批准。
8个智能体。一个循环。不需要你也能运行。
每个AI智能体都会在你停止改进它的那一刻停止进步。新的工作流每天都在GitHub上出现。更好的模式会
相似文章
我构建了一个不仅能完成任务,还能自我改进管道的智能体
作者构建了一个自主智能体,不仅能完成任务,还能通过观察结果、通过拉取请求进行更改,并使用账本验证每个更改来改进自身的代码和产品。关键洞察在于,一个严格的验证步骤——得出确认、拒绝或不确定的结论——对于系统真正学习至关重要。
@rvaniaaaa:有人构建了一个能自学新技能的AI代理。唯一的人工步骤是最终审批。8个代理。一个循环…
这个新AI代理系统由八个专门代理组成,能够自主从GitHub发现、验证并整合新技能,仅在合并前需要人类最终审批。
你实际上是如何为AI代理构建审批门的?我确信大多数都只是形同虚设
作者认为,许多针对AI代理的人工审批门效果不佳,如同虚设;并提出了一个框架,用于设计能够真正捕捉错误的有意义的审查机制。
@mattpocockuk: 我的技能组合中缺少的是复合工程所具备的东西——你的流程随时间改进的承诺……
一条推文探讨了AI技能在流程持续改进方面的不足,提出一个潜在工具如'/improve-me',用于更新编码标准并优化智能体行为。
@lijigang:回顾 Agent 的发展历程,基本就是一个不断补短板的过程:- 缺……
这篇帖子回顾了 Agent 开发的过程,认为它主要是一个不断修补短板的迭代过程——加入检索、状态管理、重试、权限和评估——同时指出,将能力外包给支撑系统与将其收回模型内部之间,始终存在持续的张力。