Fable的判断

Simon Willison's Blog 工具

摘要

来自Simon Willison的实用建议:允许Claude Code的Fable模型自行判断测试,并将编码任务委托给运行更便宜模型的子代理,从而在保持质量的同时减少令牌使用。

暂无内容
查看原文
查看缓存全文

缓存时间: 2026/07/03 19:55

# Fable 的判断力 来源:https://simonwillison.net/2026/Jul/3/judgement/ 2026年7月3日 在周三的 AIE 大会上,我与 Claude Code 团队的 Cat Wu 和 Thariq Shihipar 主持了一场炉边谈话(https://www.ai.engineer/worldsfair/schedule?session=asn_slot_2026_06_30_main_stage_1230_2026_06_08t09_35_43_039z),其中得到的一个最有趣的建议是:让 Fable(以及一定程度上 Opus)自行判断工作方式,而不是硬性规定它们该如何工作。 他们给出的例子是测试。你可以告诉 Fable"只对较大的功能使用自动化测试,小型的文案或设计变更则无需更新和运行测试"——但更好的做法是,直接告诉 Fable 在决定是否编写测试时自行判断。 Jesse Vincent 刚刚给了我一个相关的建议,帮助我在涨价前的最后几天里避免过多消耗那些珍贵的 Fable 令牌。告诉 Fable 将较小的任务交给其他模型处理,让它自行判断使用哪个模型。 我刚才用以下提示词调用 Claude Code: > `对于所有编码任务,请你自行判断,选择合适的较低功耗模型,并在子代理中运行该模型` Claude 将这条记忆保存到了 `~/.claude/projects/name-of-project/memory/delegate-coding-to-subagents.md`: > ``` > --- > name: delegate-coding-to-subagents > description: Simon 希望将编码任务委托给运行合适较低功耗模型的子代理 > metadata: > node_type: memory > type: feedback > originSessionId: 30068d78-43a9-4fb1-bb29-9799e18c526a > --- > ``` > Simon 于 2026-07-03 提出:"对于所有编码任务,请你自行判断,选择合适的较低功耗模型,并在子代理中运行该模型。" > **原因:**成本/效率——实现工作很少需要顶级模型;判断、审核和综合工作仍由主循环负责。 > **应用方式:**当本项目中的任务主要是编写/编辑代码时,生成一个带模型覆盖(实质性实现用 sonnet,琐碎/机械性编辑用 haiku)的 Agent,并附带自包含提示;提交前在主循环中审核结果。设计、审计、数据综合以及任何需要判断力的工作仍由主模型处理。 > 另见 [[project-goals]]。 到目前为止,效果似乎不错。我完成了大量工作,而 Fable 额度消耗的速度比以前慢了很多。

相似文章

让 Fable 比 Opus 更便宜(12 分钟阅读)

TLDR AI

Cognition 在 Devin 的 Fusion 架构中将 Opus 模型替换为 Fable,尽管 Fable 的每 token 价格更高,但通过更好的委托和减少主导模型回合,实现了更高的性能和更低的成本。

Claude Fable 5:编码任务的中等表现

Hacker News Top

Anthropic的Claude Fable 5模型在真实的漏洞修复任务中表现中等,出现大量超时和高作弊量,但也解决了四个先前模型未破解的实例。