标签
Kent C. Dodds 描述了有一个类似Kody的自动化设置,可以在他睡觉时修复生产环境中的bug报告,并参考了关于Omarchy的bug分类流程的采访。
Fakecloud是一个用于集成测试的本地AWS云模拟器,它支持在本地使用标准AWS客户端运行应用程序,并提供SDK以增强对105个服务的测试可见性。
本文宣布GitHub仓库'dzhng/skills'获得了1,000星标,并介绍了一种新的Karpathy风格自动研究技能,用于自主软件开发,强调了一种基于工厂的方法,利用AI代理构建软件。
Cline Desktop 新增了 SSH 支持,可实现远程开发:应用本地运行在笔记本电脑上,同时处理远程设备(如开发服务器或树莓派)上的文件和工具。
DEV·TV 是一个复古电视风格的工具,聚合了来自 GitHub、Hacker News、DEV 和 Hugging Face 的实时频道,让开发者可以在不离开工作流程的情况下浏览故事。它是一个单一的 HTML 文件,免费且采用 MIT 许可证。
本文解析了用于评估 AI 智能体回应的 Jev 与 LLM 作为评判者之间的区别,强调了根据需要开放式推理还是结构化并行判断来选择使用哪种方式。
文章比较了AI驱动的安全工具,这些工具能够检测超越基本代码检查的真实代码漏洞,并提到了Snyk、Semgrep和Coderabbit等工具。
Cursor AI 推出了 Rollouts 功能,这是一项部署监控工具,它能制定计划并监控变更,以便在回归问题影响用户之前将其捕获。
Guillermo Rauch 讨论了 @eve 架构以及 @v0 工具如何运作,并计划在 Vercel 上推荐 libfx。
Harness Manager 是一个 Mac 应用程序,充当管理 AI 编程工具的集中式平台,允许用户发现、安装和更新像 Claude Code 和 Codex 这样的工具。
作者分享了利用 Jev 和 Pi 构建自定义框架的初步想法,重点关注门控、路由和验证器,并计划在后续文章中进行更深入的探讨。
本文讨论了AI系统中评估(evals)的重要性,解释了为什么传统测试不够用,介绍了三种主要评估类型,并提供了实施建议。
斯坦福大学的CS146S课程'Modern Software Developer'教授编程代理和AI辅助开发,其公开的作业在GitHub上,涵盖提示工程和自动化工作流等主题。
作者分享了在有限硬件上使用像Ornith 1.5 35b-a3b和Qwen 3.8 27b这样的本地AI模型进行开发任务的实际经验,展示了它们在编码和故障排除方面的能力。
作者打造了CosmoRemote,这是一个使用桥接守护进程和移动应用的工具,能从手机远程构建、运行和测试Mac模拟器上的代码,解决了在外验证AI智能体工作成果的空白。
作者为VC基金数据构建了一个实时MCP服务器,并集成了Stripe的智能体支付协议(MPP),以实现使用USDC钱包的按调用付费功能,邀请他人测试并分享经验。
Cloudflare 已推出 Worker Previews,允许开发者使用 Git 分支分割环境,进行类似生产的测试,拥有独立的代码、配置、URL、可观测性和状态。
Drop是一个无根Linux沙盒工具,通过使用用户命名空间和可选的gVisor集成来隔离程序和编码代理,提供安全环境而无需容器设置开销。