我让 Codex 审查 Claude 写的 PR

Reddit r/AI_Agents 新闻

摘要

一位用户分享了一次经历:Codex 审查了 Claude 编写的 PR,发现了一个真实错误,另一个工具也标记了相同的问题。这引发了关于多个 AI 代理相互检查工作效果的质疑。

Claude 写了这个 PR。在我打开它之前,Codex 询问是否应该先审查一下。我同意了。它留下了 6 条评论。4 条是关于样式的。1 条是错误的。1 条是重试逻辑中的真实错误,coderabbit 在大约一小时前也用几乎相同的语言标记了这个问题,所以至少他们意见一致,尽管他们都没有注意到端点根本没有连接上。还有其他人这样做吗?两个代理相互检查感觉要么非常聪明,要么非常愚蠢,我分辨不出来。
查看原文

相似文章