标签
一位开发者在 OpenRouter 上比较了 GLM 5.2 与 Fable 5 和 Opus 4.8,发现 GLM 5.2 在代码审计和审查方面成本效益高,但由于测试-错误-编辑成本的累积,不适合长时间的无人值守构建。
shadcn 发布了 Agent Skill 项目 improve,让高价模型进行代码审计和规划,低价模型执行,形成可安装、可编排、带执行闭环的系统。
介绍一个基于Claude订阅运行的8阶段漏洞发现代理,复现了Cloudflare Project Glasswing论文的核心思路,通过多窄代理、故意分歧验证和可达性门控将漏洞利用分析拆解为精确步骤,无需API密钥。
一个用于 Claude Fable 5 的提示词,可审计整个代码库的漏洞、错误和攻击向量,推荐用于 vibe-coded 项目。
介绍 /improve,这是一个工具,它利用 Claude 的最强模型来审查你的代码库,识别 bug、性能问题、技术债务、缺失的测试,并编写计划供更便宜的模型执行。
对AI智能体时代大型Rails代码库的批评,提出转向基于技能的开发方式,使用智能体、Markdown技能和TypeScript实现确定性I/O。
介绍 pi-dynamic-workflows,一个让 LLM 通过生成 JavaScript 脚本动态编排多个子代理并行执行任务的工具,适用于代码审计、大型重构等场景。