我们用模型共识取代了单一模型的代码审查——让这真正奏效的一条规则

Reddit r/AI_Agents 工具

摘要

本文描述了用多个AI模型的共识取代单一模型的代码审查,只有明确批准才算数,这带来了更可靠的代码审查,但代价是更长的讨论。

背景:小团队,在自己的仓库上自用,没有外部用户,所以请持保留态度。说实话,智能体循环的核心问题在于,单个模型审查自己的工作只是走过场。它写了个 bug,然后“审查”它,说“看起来不错”,就合并了。所以我们不再信任单个审查者,而是改为共识审查。实际上,这意味着每次变更都要经过几次独立的检查,使用不同的模型和不同的角度,它们必须真正达成一致,而不仅仅是没人反对。如果其中某个模型不确定,那就是信号,变更会等待。分歧是有用的部分,而不是噪音。让这变得有效的关键规则虽然笨拙但至关重要:评论永远不算批准,只有明确的“批准”才算。你可能不会想到,在此之前,有多少“看起来没问题,但有一个担忧”被悄悄当作了同意。最终让我信服的是一个问题,审查者争论了大约31轮才达成一致,合并了一个干净的两行修复。看着很烦人。但它没有合并垃圾,这才是关键。还有人在审查/合并步骤使用多模型共识吗?还是你们只信任一个审查者?好奇大家怎么划这条线。
查看原文

相似文章