我构建了一个本地GUI,用于处理长编码任务,避免上下文腐烂

Reddit r/AI_Agents 工具

摘要

LoopTroop 是一个本地开源GUI应用程序,通过使用LLM委员会进行规划、将任务分解为独立的beads、以及带有失败记录的可控执行,来防止长编码任务中的上下文腐烂,并让开发人员始终参与其中。

大家好。我刚刚构建了一个开源项目。大多数AI编码工具在小编辑方面表现良好,但在处理较大功能时往往会偏离轨道。主要原因是上下文腐烂。当你将所有错误日志和旧代码迭代附加到一个长聊天历史中时,模型最终会失去方向。它会开始遗漏导入、忽略指令或虚构文件。为了解决这个问题,我构建了LoopTroop。它是一个本地开源GUI应用程序,旨在运行复杂的仓库级任务。它不是为速度而设计的。它缓慢而精确,优先考虑正确性和符合你的意图。以下是工作流程的结构化方式,以防止上下文腐烂:互动访谈。在触碰任何代码之前,应用程序会扫描仓库并提出一系列有针对性的问题,以解决任务中的歧义。LLM委员会规划。不依赖单个模型,而是多个配置好的模型编写PRD和任务分解的草稿。然后它们对草稿进行匿名投票。获胜的计划吸收其他草稿的最佳想法,并通过覆盖检查。任务分解。委员会将计划拆分为称为beads的独立实现单元。每个bead定义自己的目标文件和验收标准。Ralph Loops执行。应用程序逐个执行beads。如果一个bead在20分钟的时限内失败或超时,应用程序会写一条简短的错误说明,重置并开始新的执行会话。它将失败说明向前传递,以便模型从错误中学习,而不是继承被污染的聊天记录。人在循环中。开发人员在每个边界都拥有控制权。你在任何内容合并之前审查并批准规划文档和最终代码更改。前端是一个现代化的看板GUI,因此你可以在不离开应用程序的情况下并行管理多个项目和任务。我正在寻求关于架构和工作流程的反馈。任何反馈都非常欢迎。如果你尝试了该应用程序,无论它是否有效,请告诉我一声。我很乐意讨论。
查看原文

相似文章

首次实现本地真实编程工作

Reddit r/LocalLLaMA

开发者借助 Qwen3.6-35B 4-bit MLX 模型与 pi.dev 工具,在当前硬件上实现了高效的本地智能体编程,顺利完成了实际项目工单。