标签
Anthropic 宣布自 8 月 14 日起,在 Claude Code 中为 Pro、Max 和 Team 套餐默认启用自动模式,其评估结果显示,自动模式可拦截 89% 的有害操作,并能抵御所有经过测试的间接提示注入攻击。
Claude Code 现支持跨会话消息传递,允许 Claude 智能体在独立会话之间发送消息,以协调工作、分享发现并警告破坏性变更。
一位开发者分享了一个类似Claude Code或Codex的最小编码代理的9行Python实现,仅使用标准库,兼容任何OpenAI Responses API,代码已发布在GitHub上。
GitGuardian 数据显示,Claude Code 提交泄漏密钥的比例为 3.2%,而人类基线仅为 1.5%;SonarQube CLI 现已与 Claude Code 集成,可在代码进入生产环境前检测密钥并运行静态分析。
一篇探讨循环工程起源和核心组件的文章,循环工程是设计自主循环来提示AI编码代理的实践,而不是一次一条消息地提示它们,并强调客观门控和状态的重要性。
一位开发者描述了如何构建一个 Claude Code 技能,在导出前验证 AI 生成的 CAD 几何体,利用体积、边界框和点分类检查捕获 OpenCASCADE 的静默故障,例如未抽壳的零件和位置错误的切割。
介绍 Claude Code 生态中的 /swarm 多 Agent 并行扇出模式近期被默认禁用并增加硬性限制,原因在于失控递归和成本爆炸。
Anthropic announces that auto mode is now the default in Claude Code for Pro, Max, and Team plans, with safeguards against harmful actions. The tweet highlights that stacked defenses can reduce indirect prompt injection to near zero on unseen attacks.
Matt Pocock 重点介绍了一个新的 Claude Code 功能,该功能允许会话之间互相发送消息,通过传递摘要来延续任务中途的上下文,而无需共享完整历史记录或文件。
一个免费的 Claude Code 提示词,用于审计已安装的技能,并使用 Gauntlet Loop 对升级版本与原始版本进行盲测,升级或淘汰技能,以便与 Opus 5 更好地配合。
Claude Code 现在允许会话之间通过发送摘要来互相通信,使得另一个会话无需重新解释即可在任务中途获取上下文。
Claude Code 将于 8 月 14 日起将自动模式设为 Pro、Max 和 Team 用户的默认权限模式。在测试中,自动模式的独立分类器捕获了 89% 的危险命令,而手动批准仅捕获了 14%。
一位开发者描述了如何构建一个多引擎智能体编码工具集,在 Claude Code、Codex 和 Ollama 之间路由会话,并根据任务价值为每个会话从十二个模型中进行选择。
一条推文认为,Claude Code 技能可以通过直接调用图像生成 API 来替代 79 美元/月的 Higgsfield 订阅,将每张图像的成本从约 31-34 美分降至约 5 美分,同时让输出保留在本地并由用户所有。
Andrew Ng 在 2024 年的预测——即使用较弱模型的智能体工作流可以胜过较强的独立模型——已得到 Anthropic 的验证:一个协调更便宜子智能体的编排器以 90.2% 的优势击败了单个 Claude Opus。这篇文章强调了 Claude Code 子智能体作为实际实现。
CCPlugins 是一组精选的 24 个专业命令,通过结构化的开发工作流扩展 Claude Code CLI,包括清理、提交、格式化、测试、重构和安全检查,并带有安全控制和 MIT 许可证。
一篇观察架构转变的文章:LLM代理编排确定性代码,而非确定性代码调用LLM,并提供了实用的红旗和绿旗,判断这种反转何时有意义。
供 AI 代理使用的 skills 集合,在 GitHub 上拥有超过 82,000 颗星,由 Addy Osmani 创建,涵盖从 spec 到 ship 的工程流程,并兼容 Claude Code、Cursor 和 Codex。
一位开发者分享了一个Claude Code配置,其中三个结构良好的智能体胜过二十个,强调编排者的控制、范围明确的任务,以及使用廉价模型处理大量工作,同时将Opus保留给主导和审查角色。
作者评测了 Matt Pocock 发布的 agents skills 1.2 版本中的 /grill-me skill,在 Claude Code 中对比其与原生 plan mode 的需求挖掘深度,认为 grill-me 更深入但分组提问格式体验有争议。