code-editing

标签

Cards List
#code-editing

在一个为诱使代理而构建的页面上进行十五次“让一个按钮变蓝”的运行,每次都停留在一个选择器内;一个包含200个任务的陈旧错误基准测试显示,真实仓库在35%到65%的情况下走向另一条路

Reddit r/AI_Agents ↗ · 2026-09-21

关于AI代理在代码编辑任务中的实验表明,当错误已经修复时,代理经常过度编辑代码,性能根据任务指令而变化。使用真实仓库的基准测试突出了代理在软件开发中的行为问题。

0 人收藏 0 人点赞
#code-editing

差异对比与全文件生成:基于迭代编辑与直接生成方法的Flutter/Dart代码模型实证比较

Hugging Face Daily Papers ↗ · 2026-09-05 缓存

本文通过实证研究对比了用于训练Flutter/Dart代码模型的迭代编辑(差异对比)和直接生成方法,发现直接生成方法总体上更优,但差异对比法在短小、局部化的修改中表现突出。

0 人收藏 0 人点赞
#code-editing

VisEditBench:视觉语言模型能否根据多模态反馈编辑可视化代码?

arXiv cs.CL ↗ · 2026-08-12 缓存

介绍了VisEditBench,这是一个包含1,395个人工标注的可视化代码编辑任务的基准,面向视觉语言模型,涵盖反馈引导的修复和参考引导的重新样式化。评估了20个VLM,并提出了VisEditAgent,一个基于渲染的编辑框架,将通过率从55.75%提升到67.99%。

0 人收藏 0 人点赞
#code-editing

@fat:编辑功能现已在 diffs[dot]com 上线。这不仅仅是又一个 Monaco 或 ProseMirror 的封装。这是一个全新的编辑…

X AI KOLs Following ↗ · 2026-08-03 缓存

Diffs.com 推出新的编辑模式,这是一个基于其文件/差异渲染原语构建的轻量级代码编辑器,支持内联编辑、选择操作、标记、查找/替换、撤销历史以及键盘快捷键。

0 人收藏 0 人点赞
#code-editing

机器添加,人类删除:度量与缓解LLM代码编辑中的删除回避

Hugging Face Daily Papers ↗ · 2026-07-30 缓存

本文介绍了CanItDelete,一个包含200个真实世界纯删除代码编辑任务的基准,并衡量了LLM如何避免删除代码。研究发现,前沿模型经常保留过时的代码,生成可通过测试但无法直接合并的补丁,并且加入以删除为重点的训练数据可以提高性能。

0 人收藏 0 人点赞
#code-editing

@alex_prompter: 两个AI代理同时编辑同一代码库会互相破坏对方的工作,除非你给它们这个指令。同时运行两个代理…

X AI KOLs Timeline ↗ · 2026-07-14 缓存

一个实用的技巧:在同一个代码库上运行多个AI代理时,使用共享的 notes.md 文件进行协调,以避免冲突。

0 人收藏 0 人点赞
#code-editing

编程代理究竟需要什么上下文来执行操作?

arXiv cs.LG ↗ · 2026-07-14 缓存

本文研究了编程代理编辑代码所需的最小上下文,发现代码的自然语言摘要无效,且周围上下文影响不大,而压缩上下文仅用三分之一的令牌即可达到相同效果。同时,还揭示了因温度0 API推断而产生的噪声基底。

0 人收藏 0 人点赞
#code-editing

@XAMTO_AI: 终端AI编程助手这个赛道现在卷得是真离谱,oh-my-pi 算是这周杀出来的一匹黑马,目前Star数已经13.7万多了 它直接在终端里跑,最核心的卖点就一个——改代码改得极准。 这个项目是从Pi分支出来的,在原版基础上加了一大堆硬货。 最…

X AI KOLs Timeline ↗ · 2026-06-21 缓存

介绍了终端AI编程助手oh-my-pi,它从Pi分支出来,凭借Hashline编辑系统实现高精度代码修改,减少61% token消耗,内置32个工具,支持40多种语言和40多个LLM提供商,可直接从主流工具导入配置,迁移成本低。

0 人收藏 0 人点赞
#code-editing

AI 编码代理需要“先计划后编辑”的工作流程?征求反馈

Reddit r/AI_Agents ↗ · 2026-06-05

一种为 AI 编码代理提出的工作流程,强调在代码编辑之前进行头脑风暴和执行边界约束,寻求社区对其实用性的反馈。

0 人收藏 0 人点赞
#code-editing

编码模型做得太多了

Hacker News Top ↗ · 2026-04-22 缓存

一篇博客文章探讨“过度编辑”问题:编码大语言模型在修复简单错误时改写了过多代码,提出衡量指标与训练方法以鼓励最小化、忠实于原意的编辑。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈