感觉编码代理擅长找代码,但不擅长理解项目

Reddit r/AI_Agents 新闻

摘要

讨论了一个观察:编码代理虽能有效定位代码,但难以深入理解项目,比如组件关系和项目风格。作者介绍了 RepoWise,一个提供仓库级信号(如依赖图和Git历史)的工具来解决这些问题。

最近一直在摆弄编码代理,但总有些东西让我困扰。找代码似乎不再是难事了,理解项目反而更难。我经常看到这样的情况: • 重新打开他们已经探索过的文件 • 忽略组件之间的关系 • 做出能工作但不符项目风格的修改 • 反复重新发现模式 我原本以为更大的上下文窗口能解决这个问题,但现在不太确定了。我开始用 RepoWise 进行实验,主要围绕仓库级信号,如依赖图、Git历史和架构上下文。GitHub 仓库在评论中。好奇其他构建代理的人是否看到同样的问题,还是我找错了方向。
查看原文

相似文章

SWE-Explore:编码代理仓库探索能力基准测试

Hugging Face Daily Papers

SWE-Explore 引入了一个基准测试,用于评估编码代理的仓库探索能力,要求在行预算内返回相关代码区域的排序列表。实验表明,基于代理的探索优于传统检索,而行级覆盖仍然是关键区分因素。