标签
本文宣布GitHub仓库'dzhng/skills'获得了1,000星标,并介绍了一种新的Karpathy风格自动研究技能,用于自主软件开发,强调了一种基于工厂的方法,利用AI代理构建软件。
本文描述了一个用于自主编码代理的零依赖Node.js引擎的架构,其特点包括基于波的任务执行、哈希门控验证和动态模型路由,以确保高效可靠的代码生成。
Reddit 用户展示使用 Opus 5.5 和 OpenRouter API 自主创建一个关于生命意义的异想天开的手绘视频,在 AI 服务上花费约 20 美元。
Marmel 0.9.0 是自主编程代理的一个更新,专注于稳定和提升本地 AI 模型的性能,开发者邀请用户进行测试并提供反馈。
这篇文章宣布了Autoresearch Bench,一个用于编码代理自主解决研究问题的开源基准测试,指出模型在自主研究循环中存在显著差异。
这篇文章强调了使用像QWEN 3.8 27B这样的视觉启用AI模型进行编程如何通过允许模型截取屏幕截图并验证修复来改进错误检测,从而增强自主编程任务。
Arintra Health 已获得2500万美元的B轮融资,用于开发自动化医疗计费编码的人工智能,提高医院的收入获取和效率。
DeepSeek Harness的极简模式能够仅凭一次指令,自主完成从项目建立到成品交付的全流程,成功构建出赛博朋克风格的3D城市,展示了AI编程的强大能力。
一位开发者寻求实用策略,让审阅/批评AI代理发现真实缺陷,并在无需人工监督的情况下推动编码任务完成,涵盖提示、测试访问和代理分离等方面。
用户展示了一个AI代理工作流:DeepSeek-V4-Flash与Muse-Glimmer视觉模型协作,利用截图作为视觉反馈,迭代构建了一个逼真的汽车行驶HTML画布动画。在后续运行中,DeepSeek抛弃了视觉模型,转而使用PIL检查图像,在不到10分钟内生成了一个惊艳的“黄金时刻”场景。
阿里巴巴的Qwen智能体在一个空仓库中自主编码超过10天,提交issue、编写代码、运行测试、修复失败并合并。它仍然需要一些反馈,但这展示了一个自我纠错的自主循环。
作者描述了一种工作流:在夜间以单一目标、约束条件和强制性的晨间报告来运行 AI 编程代理,从而充分利用闲置的计算时间。
对后台编码代理的详细探讨——这些AI代理在云端沙箱中自主工作并开启拉取请求——将它们与自动补全和基于IDE的工具进行对比,基于FactoryKit在两周内交付超过180个功能的真实经验。
Anthropic 发布了四种让 Claude Code 自主运行的循环类型:基于回合、基于目标、基于时间和主动式,允许不同级别的任务交接。
建议使用Fable-5作为协调者,Codex作为执行者以节省积分,并附有可组合AI代理技能库的链接,用于自主软件开发。
该推文描述了一项测试,其中Ornith-1.0成功识破了一个关于使用Redis的错误前提,突显了其在自主编程中的诚实性。附带的Hugging Face页面宣布了Ornith-1.0,这是一系列开源编码智能体模型,具有最先进的基准测试成绩。
aronprins 宣布对 Claude Loop 和 Codex Loop 进行更新,增加了并行波次支持,以使用 Claude Code 实现更快速的自主编码工作流。
本文介绍了从传统提示词工程到“循环工程”的转变,开发者不再手动提示AI,而是让AI通过循环自动执行任务。文章详细解析了循环系统的核心组件、自动化带来的债务,并提供了两种实践方法。
一个使用300亿参数模型的AI智能体利用无头截图循环,自主完成了一个用C语言编写的光线追踪第一人称射击演示,展示了先进的自主编程和调试能力。
Anthropic工程师解释了如何在循环中使用Claude Code自主编写代码并管理PR,让开发者彻底远离键盘。