构建了一个工具用于对大型变更进行代理代码审查,并使用代理来理解和审查代码。
摘要
作者构建了Seendiff,一个用于代理代码审查的工具,以跟踪进度、与Claude等语言模型协作,并简化大型代码变更,同时询问其他人的审查流程。
我热爱使用大型语言模型编程,但我认为将代理代码写入任何可维护的项目仍需要人工审查。即使是最胜任的模型有时也会出错,例如过度复杂化简单事物、方法不当、忽略明显之处等。此外,大型语言模型尚未完全理解人类上下文,例如在我当前环境和业务中重要的设计权衡。我的做法是:(1)始终以计划开头,特别是当变更复杂时。计划有两个版本:一个是Claude用自己的(人类难以解析的)语言写的计划;第二个是简化的,用STE100写的,我可以解析的版本。(2)在合并之前阅读/浏览所有它已完成的内容。我认为,如果你想仍然保持代码库属于你,而不是完全YOLO(随心所欲)地搞你的项目,这是最低要求。对于(2),我尝试了很多工具——VS Code差异、GitHub差异、Meld——似乎没有一个具有我这个特定工作流程所需的所有功能:a. 跟踪我看过的内容;b. 逐块审查/批准;c. 与语言模型协作以理解代码。Seendiff试图以最小的资源占用解决上述问题。你的代理代码审查流程是什么样的?
相似文章
seendiff
seendiff 是一款本地代码差异查看器,有助于跟踪审查进度并支持基于代码块的审查,同时集成了编程代理以解释其工作。
Agentic Code Review(15分钟阅读)
分析AI编码代理如何将瓶颈从编写代码转移到审查代码,数据显示代码变更量增加861%,缺陷率上升,使得代码审查成为软件工程中最具杠杆效应的技能。
Open Code Review – 一款由 AI 驱动的代码审查 CLI 工具
阿里巴巴已将 Open Code Review 开源,这是一款由 AI 驱动的代码审查 CLI 工具,将确定性工程方法与 LLM 智能体能力相结合。该工具最初作为内部工具使用,服务于数万名开发者,已识别出数百万处缺陷。它通过读取 Git diff 输出,利用可配置的模型端点生成结构化的行级审查意见。
Show HN:adamsreview – 为 Claude Code 提供优化的多智能体 PR 审查
介绍 adamsreview,这是一个开源的 Claude Code 插件,它通过采用并行子代理、验证关卡以及自动修复循环的多智能体流水线,能够以更少的误报检测出更多 Bug,从而增强拉取请求(Pull Request)的审查效果。
使用AI进行代码审查,尤其是在diff很大的情况下
文章认为,人类代码审阅者应使用AI来处理大型diff,并贡献其分布外知识和高级上下文。