Fable的判断
摘要
来自Simon Willison的实用建议:允许Claude Code的Fable模型自行判断测试,并将编码任务委托给运行更便宜模型的子代理,从而在保持质量的同时减少令牌使用。
暂无内容
查看缓存全文
缓存时间: 2026/07/03 19:55
# Fable 的判断力
来源:https://simonwillison.net/2026/Jul/3/judgement/
2026年7月3日
在周三的 AIE 大会上,我与 Claude Code 团队的 Cat Wu 和 Thariq Shihipar 主持了一场炉边谈话(https://www.ai.engineer/worldsfair/schedule?session=asn_slot_2026_06_30_main_stage_1230_2026_06_08t09_35_43_039z),其中得到的一个最有趣的建议是:让 Fable(以及一定程度上 Opus)自行判断工作方式,而不是硬性规定它们该如何工作。
他们给出的例子是测试。你可以告诉 Fable"只对较大的功能使用自动化测试,小型的文案或设计变更则无需更新和运行测试"——但更好的做法是,直接告诉 Fable 在决定是否编写测试时自行判断。
Jesse Vincent 刚刚给了我一个相关的建议,帮助我在涨价前的最后几天里避免过多消耗那些珍贵的 Fable 令牌。告诉 Fable 将较小的任务交给其他模型处理,让它自行判断使用哪个模型。
我刚才用以下提示词调用 Claude Code:
> `对于所有编码任务,请你自行判断,选择合适的较低功耗模型,并在子代理中运行该模型`
Claude 将这条记忆保存到了 `~/.claude/projects/name-of-project/memory/delegate-coding-to-subagents.md`:
> ```
> ---
> name: delegate-coding-to-subagents
> description: Simon 希望将编码任务委托给运行合适较低功耗模型的子代理
> metadata:
> node_type: memory
> type: feedback
> originSessionId: 30068d78-43a9-4fb1-bb29-9799e18c526a
> ---
> ```
> Simon 于 2026-07-03 提出:"对于所有编码任务,请你自行判断,选择合适的较低功耗模型,并在子代理中运行该模型。"
> **原因:**成本/效率——实现工作很少需要顶级模型;判断、审核和综合工作仍由主循环负责。
> **应用方式:**当本项目中的任务主要是编写/编辑代码时,生成一个带模型覆盖(实质性实现用 sonnet,琐碎/机械性编辑用 haiku)的 Agent,并附带自包含提示;提交前在主循环中审核结果。设计、审计、数据综合以及任何需要判断力的工作仍由主模型处理。
> 另见 [[project-goals]]。
到目前为止,效果似乎不错。我完成了大量工作,而 Fable 额度消耗的速度比以前慢了很多。
相似文章
让Fable自行判断,而不是规定其工作方式(2分钟阅读)
使用Fable和Opus等AI编码工具的实用技巧:让它们自行判断而不是规定行为,并通过子代理将较小的任务委托给较低功耗的模型,以节省token并提高效率。
/architect: 将Fable令牌减少80%,Fable编排/审查,Codex构建
介绍了architect-loop,一个跨供应商的开发循环,其中Claude Fable负责架构和审查工作切片,而GPT-5.5 Codex并行进行构建和研究,使用固定费率订阅而非API令牌。
让 Fable 比 Opus 更便宜(12 分钟阅读)
Cognition 在 Devin 的 Fusion 架构中将 Opus 模型替换为 Fable,尽管 Fable 的每 token 价格更高,但通过更好的委托和减少主导模型回合,实现了更高的性能和更低的成本。
Claude Fable 5:编码任务的中等表现
Anthropic的Claude Fable 5模型在真实的漏洞修复任务中表现中等,出现大量超时和高作弊量,但也解决了四个先前模型未破解的实例。
@FinanceYF5: ClaudeDevs 分享了他们在使用 Fable 5 时经常采用的几种模式: 把 Fable 5 当成“顾问”。 由执行器 Sonnet 5 调用 Fable 5 获取指导。 这样,大部分 Token 都会按照更低的执行器价格计费。
ClaudeDevs 分享了使用 Fable 5 作为顾问的模式,由执行器 Sonnet 5 调用以利用更低的计费价格节省 Token 成本。