我们使用7代理Claude工作流在72小时内构建了一个生产级应用。

Reddit r/AI_Agents 新闻

摘要

一个由3名工程师组成的团队使用7代理Claude工作流在72小时内构建了一个生产级应用,预计节省了约60小时的人工审查时间。该工作流包括专门负责架构、构建、审查、修复、安全、设计和TODO检测的代理。

现在有很多关于“解雇团队,让AI做所有事”的幻想。但把AI当作魔法通常会导致无休止的提示调试。最近,我们3人工程师团队在72小时内构建了一个完整的生产级应用(这项工作通常至少需要2个月)。秘诀不是让一个全能的AI写所有代码,而是把Claude当作一个有严格边界、审查循环和Git轨迹的工程工具。我们构建了一个建筑可持续性基准平台,使用React 19、Python和带pgvector的PostgreSQL摄取约30000栋纽约市建筑的数据。我们将工作负载分配给7个严格专业化的Claude代理,每个代理职责明确: **1. 架构师(只读)** 架构师不会盲目编写代码,而是探索代码库,找到可复用的工具,并编写严格的实现计划。它从不写代码,因此不会为了维护糟糕的实现而固执己见。它会检查跨仓库依赖,确保我们没有重复造轮子。 **2. 构建者** 构建者只是执行者。它严格按照架构师的计划和项目约定实现功能。完成后,它运行linting和类型检查,然后移交工作。 **3. 评审者(只读)** 评审者是守门人。它根据固定的严重性等级对构建者的更改文件进行评分:P0(正确性)、P0.5(安全性)、P1(架构)、P2(类型),一直到框架模式。它将验收标准映射到实际的代码证据,并返回PASS或NEEDS FIXES报告。规则是:它不能修复任何问题,只报告。 **4. 修复者** 修复者接受评审者的报告,并严格按优先级顺序应用修复(先处理MUST FIX和SHOULD FIX项),保持改动最小。我们故意将修复者与评审者分开——修补代码的代理不应与决定补丁是否合格的代理是同一个。 **5. 安全评审者** 该代理与主循环并行运行,专门检查高风险漏洞:SQL注入、提示注入、CORS配置、数据泄漏以及密钥泄漏到前端。如果它在源代码或历史中发现密钥,立即触发停止。 **6. 设计评审者** 这节省了大量时间。它通过DevTools MCP驱动Chrome,拍摄1440px和375px的截图,并对照shadcn/Tailwind约定和设计标记评审UI。这使我们无需人工或Figma参与即可进行视觉QA。 **7. TODO查找器** 快速构建会遗留技术债务。该代理扫描代码库中的TODO/FIXME标记、占位内容、硬编码URL、多余的console.log以及缺失的环境变量,确保没有半成品被推送到生产环境。 通过强制这些代理按严重性进行循环工作(评审者→修复者→评审者),我们节省了大约60小时的人工审查时间。每个代理操作都通过MCP关联到GitHub Issue,并在Git中完全可见。总共合并了127个PR。代理处理了第一轮繁重工作,而我们3名人类工程师仅做最终的判断决策。 希望这能帮助你们中的一些人构建自己的代理工作流。不要再让你的Claude代理一次性做所有事。给它一个具体的任务、一个严格的边界,以及一个同事来评审它的工作。
查看原文

相似文章