标签
讨论AI编程代理需要超越源代码的运行时感知能力,例如检查容器、端口和服务,并考虑代理应对开发环境拥有多大程度的控制权。
一个基于 Rust 的本地代码索引,供编码代理使用,无需语言服务器即可解析导入,使用 oxc 处理 JS/TS,使用 stack-graphs 处理 Python/Java,完全离线运行,并返回带注释且不夸大的调用点结果。
swyx宣布了一项10,000美元的周末竞赛,使用任何编码代理和模型来干掉他的SaaS,token消耗上限500美元;截止日期延长至周三。
一篇探讨循环工程起源和核心组件的文章,循环工程是设计自主循环来提示AI编码代理的实践,而不是一次一条消息地提示它们,并强调客观门控和状态的重要性。
本文讨论AI编程Agent的Skills生态爆发,介绍多个高star的Agent Skills仓库(如superpowers、agent-skills等),它们为AI编程代理提供工程规范,旨在缩小Vibe Coding与生产级代码之间的质量差距。
Herdr 现已获得 YC 支持,推出了 Vercel Sandbox 插件,让开发者可以在本地 Herdr 面板中于隔离环境中运行多个编码代理。
一项在 SWE-bench Pro 上比较 10 种编码智能体框架(harness)的研究表明,框架选择会显著影响 pass@1 和成本,并揭示厂商提供的框架对大型模型过拟合,无法迁移到较小的模型。
主张在编码智能体工作流中,LLM应仅用于推理,而由确定性基础设施处理队列、状态、重试和恢复,这样即使达到使用限制,流程也不会中断。
介绍bb,一个开源、MIT许可的智能体IDE,它充当智能体编排器,用户可扩展它以构建自定义功能,包括任务管理、代码审查等。
Herdr,一个面向终端编码代理的开源运行时和 TUI,正在加入 Y Combinator 的 F26 批次。该项目拥有 25k stars 和 340k 下载量,将继续采用 Apache-2.0 许可证。
这是一场关于开发者如何为编码代理处理凭据的讨论,探讨了一种让代理无需接收原始密钥即可使用 API 的方案:在请求时注入凭据,并限制允许的目标地址。作者正将这一方案构建为 Stashbase 的一部分,并邀请大家分享各自的实践。
一项并排编码实验对比了GPT-5.6 Luna与DeepSeek V4 Flash,结果显示,在计入重试后,DeepSeek看似5倍的价格优势大幅缩水。文章主张采用更全面的基准测试,报告每次尝试的成本和每次验证成功的成本。
一位开发者描述了编码代理 PreToolUse 护栏中的一个常见 bug:护栏将所有工具参数扁平化为单个字符串并统一分类,导致代理仅仅提及禁止话题时就产生误报。修复方法是同时考虑字符串和工具的实际效果。
Not Diamond 宣布推出 Not Diamond Code,这是一款面向编码代理的智能模型路由器,可根据每个步骤选择最佳模型和推理工作量,声称可节省 20% 以上的成本,并在编码基准测试中实现帕累托最优性能。
Not Diamond Code 是一款面向长期编码代理的智能模型路由器,为每一步选择最佳模型和推理努力,可将成本降低 20-65%。
Cortex is an open-source local memory and autopilot layer for coding agents like Claude Code and Codex, using SQLite to persist context across sessions and optionally run tasks autonomously.
本文综述了自演化编码智能体,这类智能体通过从先前的编码交互中更新框架、记忆、技能、工具或模型来改进其未来行为,并提出了一个分类体系,涵盖演化什么、何时演化以及由哪些软件特定证据驱动。
一位开发者分享了他们对 Claude Code 代理指令文件的审计,删除了其中71%的文件并对冗余内容进行分类,提供了一个用于决定保留内容的评判标准,以及一个用于衡量指令占用空间的脚本。
作者构建了 mex,一个帮助编码智能体保留仓库知识而不用重复阅读的工具,v0.7.0 增加了本地代码图,将上下文使用量减少了 90.7%,同时保持了召回率。
Hoplite(YC S26)推出一个平台,用于部署云端编码智能体,可迁移本地设置,并支持跨用户流程、API 和 CLI 对功能进行并发 QA。创始人 Bence 和 Ryan 在 AWS、Temporal、Modal 和 Planetscale 上构建了自定义智能体框架,可通过代码 'HACKERNEWS' 获取免费额度。