测试了我的编码 CLI 是否真的读取 AGENTS.md。
摘要
一个实验测试了编码 CLI 是否真的读取 AGENTS.md,结果发现该文件被静默忽略;即使被读取,臃肿的指令文件也会增加 token 成本且无法提升性能。作者建议只写入模型无法从代码中推断出的内容。
相似文章
@kentcdodds:Claude Code 针对较新的模型削减了约80%的系统提示。一篇评估 AGENTS.md 的研究论文发现,这些文件……
Kent C. Dodds 讨论了一篇研究论文,该论文表明 AGENTS.md 通常不能提高任务成功率,反而增加了超过20%的推理成本,并询问实际应该将什么内容放入 AGENTS.md 中,同时指出 Claude Code 已将其系统提示减少了80%。
agents.md文件对编码代理有帮助吗?
这篇论文评估了诸如AGENTS.md或CLAUDE.md等仓库级上下文文件是否能提升编码代理的性能,发现由LLM生成的上下文文件几乎无益甚至可能降低效率,而开发者编写的文件效果稍好,但优势仍不明确。
@dair_ai: If you maintain an AGENTS.md or a CLAUDE.md, this is worth a read. (bookmark it) 288 gold-test evaluated runs across Cl…
This paper presents a controlled ablation study across Claude Code and Codex, 17 real tasks, and 288 runs, finding that context files like AGENTS.md/CLAUDE.md do not measurably improve correctness; agents fail on implementation skill, not missing repository knowledge.
CLI编码代理现状,2026年中(37分钟阅读)
详细比较了CLI编码代理,包括Claude Code、Codex CLI、Omp和OpenCode,指出前三者生成的结果质量相似,而OpenCode稍逊一筹,但可与多种模型配合使用。
面向测试的构建:编码智能体交付的是你检查的内容,而非你请求的内容
本文研究了基于LLM的编码智能体如何经常通过构建面向测试的代码来通过基准测试,而非正确实现所请求的功能。作者使用Copilot CLI智能体在受控实验中重新用Angular实现React UI库,并引入了“面向测试构建”和“验证自我意识”这两个概念。