@omarsar0: 很好的提示。实际上,大致上就是这样让智能体自主运行数小时或数天的。使用 /goal 或 /loop 来继续……
摘要
一个分享让AI智能体自主长时间运行实用技巧的帖子,重点介绍Opus模型,涉及权限、动态工作流和验证方面的建议。
查看缓存全文
缓存时间: 2026/06/08 21:28
很棒的建议。
在实践中,让代理自主运行几小时甚至几天时,大致的操作方式如下:
- 使用
/goal或/loop持续执行任务。 - 验证环环节至关重要。
接下来几周,我们将在学院里深入探讨这方面内容。
加入我们:https://academy.dair.ai/events
我想额外补充一点,因为目前关于代理循环(agent loops)的热度有点过度。这种方法对于维护代码库以及那些易于验证的场景(换言之,你可以设定明确的、代理能够达成的条件)效果很好。然而,对于许多其他领域和实际用例来说,人工参与是必不可少的。因此,我认为更好的方式是设计既能支持自主运行,又能方便人类协作与输入的循环结构。这正是我最近在努力的方向——我认为应对“AI胡扯”很重要,我担心那些天真的循环纯粹依赖AI模型的能力(缺乏知识和世界理解)会产生这类低质量输出。
目前关于“循环”的讨论大多假设条件可以自动验证。当然,也可以将人工验证(比如升级触发机制)融入其中。但根据我使用编码代理循环的经验,如果提供了人工介入选项,代理往往会过度频繁地触发升级,因此这需要谨慎设置。
确实如此,这样子必然会生成大量粗糙的代码。
相似文章
@omarsar0: 如何有效运行自主长时编码代理?这是关于代理的最激动人心的讨论之一……
一场关于如何有效运行自主长时编码代理的录播讨论,包含目标设定、模型选择及最佳实践等见解,现已免费提供。
@ericzakariasson: https://x.com/ericzakariasson/status/2070493377267646797
一份实用指南,介绍如何为AI编码代理设置迭代循环,包括定义的停止条件、云端执行和通知渠道,以便卸载工作而无需持续监控。
@omarsar0: 随着我们针对长期任务中更复杂的编码代理使用(例如,动态工作流和 /goals),你会开始...
讨论了编码代理在复杂长期任务中的挑战,指出了奇怪的用户体验问题和低效的代理交互,并主张对代理框架拥有更多控制权。
@s4yonnara: https://x.com/s4yonnara/status/2070797048471756948
一份关于为AI编码智能体构建自主循环的指南,解释了如何设计系统,使智能体能够无需人工干预地重复运行任务,并阐述了何时值得使用循环以及如何安全构建它们。
@jasonzhou1993: https://x.com/jasonzhou1993/status/2075179471951614381
作者分享了运行AI代理循环一个月后的实际经验,强调了循环契约、状态和日志的重要性,以使代理实现自主和可靠。