@svpino:用Claude Code写代码,用Codex验证它。我遇到了一个团队,他们已经这样做了几个星期。我……

X AI KOLs Following 新闻

摘要

一位开发者分享了一种方法:团队使用Claude Code编写代码,使用Codex进行验证,并专注于详细的规格说明和隔夜AI代理运行。

用Claude Code写代码,用Codex来验证。 我遇到了一个团队,他们已经这样做了几个星期。我认为这是一个有趣的方法。 他们大部分时间都在编写他们想要构建的内容的规格说明。这包括架构决策、约束、开放问题、接口、依赖关系、边缘情况、验收标准,以及他们认为相关的一切。 这些是活文档。团队(主要)会为它们做贡献,但他们也让模型做出贡献。 • Claude Code和Codex都可以访问这些规格说明。 • Fable 5和Opus负责编写代码。 • Sol负责验证代码,并根据值得纳入下一次迭代的经验教训更新规格说明。 流程如下: 团队(编写规格)→ Fable(编码)→ Sol(测试)→ Sol(更新规格) 当他们刚开始这样做时,每次编码迭代都非常短(几分钟)。现在,他们正尝试进行长时间的编码会话(数小时)。 这些开发者理想的一天是这样的: 1. 检查模型前一晚所做的一切 2. 进行调整和修正 3. 发布新版本 4. 更新规格说明,补充完成新迭代所需的细节 5. 回家前运行代理 模型通宵完成工作,第二天流程再次开始。 当然,这并不总是如此,目前最大的挑战之一是如何提供足够的细节,以增加模型“有效工作时间”(即它们工作的时间),同时尽量减少它们钻牛角尖的次数。 我觉得非常有趣的是,我们如何将编程从编写奇怪的指令转变为编写英语语句。 编程并没有死,因为我们仍然在思考和编写让计算机执行的指令。我们只是改变了语言。
查看原文
查看缓存全文

缓存时间: 2026/08/12 16:33

Claude Code 负责写代码,Codex 负责验证。

我遇到一个团队,他们已经这样做几周了。我觉得这是个挺有意思的思路。

他们大部分时间都在写自己想要构建的内容的规格说明。这包括架构决策、约束条件、待解决问题、接口、依赖关系、边界情况、验收标准,以及他们认为相关的所有东西。

这些是活文档。团队主要贡献这些文档,但他们也让模型参与贡献。

• Claude Code 和 Codex 都能访问这些规格说明。

• Fable 5 和 Opus 负责写代码。

• Sol 负责验证代码,并把经验教训更新到规格说明中,供下一轮迭代参考。

流程是这样的:

团队(写规格) → Fable(编码) → Sol(测试) → Sol(更新规格)

刚开始这么做的时候,每次编码迭代都非常短(几分钟)。现在,他们正尝试运行长时间编码会话(几小时)。

这些开发者理想的一天是这样的:

  1. 检查模型昨晚做的所有工作
  2. 做出调整和修正
  3. 发布新版本
  4. 更新规格说明,补充完成新一轮迭代所需的细节
  5. 下班前运行 agents

模型通宵做工作,第二天流程再次开始。

当然,事情并不总是这么顺利。目前最大的挑战之一,是想出足够多的细节来增加模型的“受力时间”(也就是它们工作的时间),同时尽量减少它们钻牛角尖的次数。

我觉得特别有意思的是,我们已经把编码从写奇怪的指令,变成了写英文陈述。

编码并没有死,因为我们仍然在思考,仍然在写让计算机执行的指令。我们只是换了语言。

相似文章