不共享工作流而为每位工程师提供AI代理,只会自动化分歧
摘要
本文讨论了工程团队中AI代理工作流不一致的问题,并介绍了OmniNode,这是一款通过明确标准和验证来标准化代理工作以提升系统可靠性的工具。
在我上一份工作中,我注意到的问题并非人们缺乏AI工具。大家在使用这些工具,但每个人的工作流都不同。没有共同流程,没有关于有效方法的共享回顾,也没有可靠的方式让个人的成功技术融入团队运作。这意味着结果取决于谁恰好在操作代理。一位工程师有严谨的完成定义,另一位依赖摘要,还有其他人拥有一个无人知晓的优秀提示。组织获得了更快的个人,但未形成更可靠的系统。如今构建OmniNode,我试图将代理工作视为更规范的工程流程。任务以明确的验收标准开始。代理可以报告完成,但该报告仅是一种声明。独立的验证器检查工件和机械化的完成标准。当相同摩擦再现时,它会被记录在案。一旦失败类别稳定且可机械化识别,我们解决直接问题并添加验证器或关卡,让整个系统从中学习。这并不会让代理更智能,而是避免组织在每个会话和团队中重复支付学习相同教训的代价。大多数公司已有规划、审查、测试和回顾流程。我惊讶于这些结构很少应用于代理工作流。你的团队如今分享的哪些内容比个人提示和聊天历史更为持久?
相似文章
构建确定性工作流的AI Agent
一位开发者分享了一个基于AI Agent的自动化平台实验,该平台用于构建和管理确定性工作流,并寻求社区反馈。
AI代理是否重新引入了软件工程已解决的问题?
本文探讨了AI代理工作流如何重新引入软件工程在可重复性、可审计性和状态管理方面的挑战,这些挑战此前已通过版本控制、CI/CD和静态代码实践得以解决,同时提到了GitHub的Agentic Workflows和git原生方法等新兴解决方案。
AI智能体在实际工作流中真正失败的地方(非演示环境)
讨论AI智能体在实际工作流中失败的地方,重点指出协调问题、混乱输入下的可靠性问题,以及在生产中减少人工干预的挑战。
是否真的有人能良好地编排多智能体工作流,还是我们都在拼凑应付?
一篇反思性文章,质疑是否有人成功实现了多智能体AI工作流编排,而没有诉诸临时解决方案。
我们是否把太多工作流程称为“智能体”?
作者质疑许多所谓的AI智能体是否更适合被称为工作流程,并认为对于可重复的浏览器任务,定义好的工作流程可能比每次重新解释步骤的智能体更可靠。