标签
作者讨论了在CI/CD中由于LLM的非确定性,AI代理工具调用自动化回归测试面临的挑战,并寻求社区关于有效设置和痛点的见解。
本文提供了一个指南,介绍如何使用LangSmith LLM Gateway来设置和执行成本控制,以管理使用多个LLM代理时的开支。
Firetiger 是一家构建用于监控和修复生产软件智能体的初创公司,现加入 Cursor。该团队将帮助 Cursor 构建长期运行的自主智能体,使其能够交付代码、观察在生产环境中的运行情况并响应问题。
讨论AI编程代理需要超越源代码的运行时感知能力,例如检查容器、端口和服务,并考虑代理应对开发环境拥有多大程度的控制权。
Simon Willison 分享了 David Crawshaw 的 prompt 中的一段话,建议设置一个每晚运行的 cron 任务,拉取上游更改、变基本地更改,并验证软件是否正常工作。这体现了开源开发工具的理念。
认为像 Claude 和 Codex 这样的 LLM 降低了阅读和修改开源代码的门槛,使开源梦想更加可行。
作者认为开发者工具必须是开源的,因为AI智能体使得个性化软件和自动将本地更改变基到上游发布变得切实可行,并以他们的智能体Shelley和meat.dev项目为例。
bolt.new 正在推出一个免费的安全工程师代理,它在六个安全类别中对应用进行深度扫描,并在修复与部署之间加入构建验证,旨在缩小由更快的 AI 代码生成所带来的安全差距。
lobste.rs 网站存在一个影响登录用户的 JavaScript 错误;本文提供了使用 DevTools 覆盖或 TamperMonkey 脚本的缓解方法。
文章认为,撰写冲刺回顾的困难实际上是一个跨多工具的数据连接问题,而非写作问题,并介绍了Runner作为一款连接50多个应用、自动拉取上下文并生成草稿的工具。
推荐三个在HN上热传的coding agent配套工具:Clawk(给agent一次性Linux VM)、Mindwalk(3D代码库地图回放session)、Juggler(开源GUI coding agent)。
Sentry 和 GitHub 将于 7 月 15 日举办一场研讨会,演示一个自动修复错误的循环:Sentry 捕获错误,Seer 诊断问题,Copilot 以 PR 形式打开修复。
Servo 0.3.0 发布,包含 391 次提交,新增字体功能、无需快速启动的 MP4 支持、新的 DOM API 以及 DevTools 黑盒化等改进。
这条推文讨论了科技就业市场中一个反复出现的“第22条军规”:公司因收到的求职申请过于杂乱而难以招聘到产品型工程师、开发者工具基础架构专家等特定人才,而符合条件的候选人却很少能被注意到。
SaZabi 正在构建一个 AI 可观测性系统,以日志作为唯一真实来源来自动化调试和问题解决,旨在缩小自动化代码与手动调试之间的鸿沟。
一条推文讨论了在营销中专注于单个用户故事的力量,同时强调了Sazabi(一个自愈可观测性平台)获得的800万美元融资。
Codex Security 上线三个月已扫描3万个代码库、超3000万次提交,修复超50万个漏洞,展示了AI自动化的高效。
agent-browser is a CLI tool for browser automation designed for AI agents, using compact text output and ref-based element selection to minimize token usage. The post also highlights three other tools—portless, emulate, and ai-cli—for improving agent loop efficiency.
据报道,印度开发者工具初创公司 Composio 正在与 OpenAI 进行收购谈判,这可能是印度科技初创企业的一大进展。