@NielsRogge: http://paperswithco.de上的热门论文是"FastContext: Training Efficient Repository Explorer for Coding Agents"…
摘要
微软的FastContext是一篇热门论文,介绍了一个搭配编码代理用于高效代码检索的4B小模型,在SWE-Bench Multilingual上能与闭源系统匹敌。
查看缓存全文
缓存时间: 2026/06/16 17:39
截至http://paperswithco.de的热门论文是《FastContext: Training Efficient Repository Explorer for Coding Agents》
微软训练了一个较小的4B模型(可在Hugging Face上获取),可与编码代理配对,实现高效代码检索。
这样,他们就能在SWE-Bench Multilingual上与闭源模型一较高下。
阅读更多:https://paperswithcode.co/paper/2606.14066…
相似文章
FastContext:训练高效的编码代理仓库探索器
FastContext引入了专门的探索模型,将LLM代理中的仓库探索与代码求解分离,将Token消耗降低多达60%,同时提升软件工程基准上的解决率。
@barrowjoseph:我认为微软FastContext论文很好地展示了公司即将构建的代理系统类型……
一篇来自微软和上海交通大学的研究论文介绍了FastContext,这是一个专为编码代理设计的探索性子代理,它将代码库导航与任务求解分离,将编排器的令牌使用量降低高达60%,并在SWE-bench基准测试中将解决率提升5.5%。
SWE Context Bench 刚刚证明了一件我想很多编码代理用户已经感受到的事情
新的基准论文《SWE Context Bench》测试编码代理能否跨任务复用知识,凸显了现有基准仅评估孤立问题解决的不足。作者讨论了外部记忆等解决方案,并提到了 langmem、mem0、supermemory 和 Greplica 等工具。
我为代码智能体构建了一个上下文窗口优化框架——开源 + 论文
作者介绍了“Apohara Context Forge”,这是一个开源框架及方法论,旨在通过角色感知分割和分层相关性评分来优化代码智能体的上下文窗口。
@rohanpaul_ai: Meta 论文显示,当编程代理重复使用过去尝试的简短摘要而不是原始日志时,其性能会显著提升……
一篇 Meta 论文显示,编程代理在重复使用过去尝试的简短摘要而非原始日志时性能显著提升,使用 Claude 4.5 Opus 在 SWE-Bench 和 Terminal-Bench 上取得了显著改进。