@marfinxx:微软研究人员发表了一项里程碑式研究,定义了从 Harness Engineering 到 Loop Engineering 的转变,在编码…
摘要
微软研究人员发表了一项里程碑式研究,介绍了 LoopsBench,一个用于评估自纠正编码智能体循环的框架,并概述了从 Harness Engineering 到 Loop Engineering 的转变,以实现可靠的自主开发。
查看缓存全文
缓存时间: 2026/08/10 07:27
Microsoft 研究人员发布了一项里程碑式研究,定义了编码智能体从 Harness 工程到 Loop 工程的转变
对于部署自主开发者、Claude Code 循环以及生产执行 harness 的软件架构师至关重要
在静态 harness 包装器上评估编码智能体存在根本性缺陷:随着任务范围的扩大,一次性提示会失效,因为不受管理的循环会遭遇状态漂移和无法恢复的执行错误
他们的 LoopsBench 框架为自校正智能体循环建立了一个动态评估栈
生产循环栈的六大内部机制:
01 证据门控重试控制 → 评估中间执行日志以触发有针对性的重试,而不是在完整的提示词重跑上浪费 token
02 零等待连续执行 → 跨执行步骤调度非阻塞工具调用,无需开发者的延迟等待
03 上下文隔离的循环状态 → 在验证后剥离中间错误冗余,使工作内存在 50+ 个执行回合中保持干净
04 执行状态检查点 → 在每个成功的子任务后保存经过验证的 AST 树快照,以便在失败时即时回滚
05 自动化诊断探测 → 向候选代码路径注入有针对性的测试探针,以隔离编译器和运行时异常
06 确定性收敛门 → 当所有 linter 规则和单元测试断言通过时,自动终止执行循环
统一 Harness 工程与自校正循环控制,将非确定性编码模型转变为可靠的生产级软件工程师
在下方文章中阅读完整解析 ↓
相似文章
@PrajwalTomar_: 大家现在都在讨论循环工程。如果你不确定它到底是什么意思,这里用通俗的话解释一下……
解释了循环工程是从手动提示到自主AI循环的转变,这些循环自动运行任务,仅在需要时才让人参与。由Claude Code的创建者Boris Cherny推广。
@Maxsteinbrenner:提示工程已被循环工程取代。它是什么?(60秒解释)过去两年我们…
解释了从提示工程到循环工程的转变,AI智能体被赋予目标,通过递归循环(研究、起草、评估、测试、改进)迭代,直到达到标准,包括开放、封闭和编排三种循环方法。
@jasonzhou1993: https://x.com/jasonzhou1993/status/2067937943545897143
循环工程是一种系统设计实践,让AI代理自主决定工作内容、执行并迭代,通过构建跨领域复合的外循环来超越手动提示。文章解释了两层代理框架,以及如何在循环间共享工件以促进累积学习。
@RohOnChain: 这是互联网上学习循环工程的最佳网站。完全免费。大多数AI工程师从未听说过它…
一篇介绍循环工程的文章,认为它是2026年提示工程的继承者,重点在于设计智能体循环而非手写提示,并强调验证者是瓶颈。
@0xCodez: https://x.com/0xCodez/status/2064374643729773029
一个包含14个步骤的循环工程路线图,指导开发者从手动提示AI编码代理到设计自动化系统,由系统自行处理提示、验证和迭代。