@zihaozhang__: 感谢分享我们的作品,AK!非常感激
摘要
一位用户感谢 AK 分享了他们的论文 'An Empirical Study of Harness Design for Coding Agents',该论文专注于软件工程中的 AI 研究。
非常感谢分享我们的工作,AK!真的非常感激 🙌
查看缓存全文
缓存时间: 2026/09/19 04:52
太感谢你分享我们的研究成果了,AK!真的非常感激 🙌
AK (@_akhaliq): 《关于编程智能体中提示词设计的实证研究》
论文:
相似文章
@qizhengz_alex: 非常感谢您推荐我们的工作,ACE(Agentic Context Engineering)和 Meta-Harness!@lilianweng 我打赌:harness …
ACE (Agentic Context Engineering) 引入了一个框架,将上下文视为不断演化的剧本,防止上下文崩溃,并提高在智能体和特定领域基准测试上的性能。该工作强调了 harness engineering 作为模型训练数据引擎的潜力。
@krystal_ning: 感谢分享我们的调研!我们还在维护一个 Awesome Code as Agent Harness Papers 仓库,用于收集近期关于…
Krystal Ning 分享了一个精选的 Awesome 列表仓库,收录关于以代码为中心的智能体系统和工具链工程的论文,该列表伴随一项名为“Code as Agent Harness”的调研。
编码代理工具架设计的实证研究
本文实证研究了编码代理的工具架设计,评估了规划和上下文管理等组件,以提高软件工程任务的性能。
@dair_ai: 来自 Zoom 和同事的非常有趣的工作。如果您维护一个手工构建的编码框架,这里有一些很棒的见解……
本文总结了针对编码代理的框架设计的实证研究,表明上下文管理可防止溢出故障、在 LLM 摘要之前进行基于规则的省略具有成本效益,并且规划的作用随模型强度而变化。
@h100envy: 这篇论文彻底改变了我对自主工程智能体的看法:给智能体一个界面,而不是bash -> ...
本文介绍了针对自主编码智能体的智能体-计算机接口(ACI),用专为导航、编辑和反馈设计的命令取代原始bash,在SWE-bench和HumanEvalFix上取得了最先进的结果。