@FinanceYF5: 后悔Fable 5被叫停前没有用上?他连续跑了 6 天 1/ 大多数人把 Fable 5 当更快的聊天框 有人让一个 Fable 5 智能体连续跑了 6 天、没人掌舵,才动笔写下结论:九成人只用到了它 10% 的能力。 它为「连续跑几天」…
摘要
一位用户让Fable 5智能体连续运行6天无人干预,得出结论:大多数人仅使用了其10%的能力。
查看缓存全文
缓存时间: 2026/06/16 17:38
后悔Fable 5被叫停前没有用上?他连续跑了 6 天👇
1/ 🚀 大多数人把 Fable 5 当更快的聊天框
有人让一个 Fable 5 智能体连续跑了 6 天、没人掌舵,才动笔写下结论:九成人只用到了它 10% 的能力。
它为「连续跑几天」而生,人们却只用几分钟。 https://t.co/bCqmgKh0Vp
后悔Fable 5被叫停前没有用上?他连续跑了 6 天
1/ 大多数人把 Fable 5 当更快的聊天框
有人让一个 Fable 5 智能体连续跑了 6 天、没人掌舵,才动笔写下结论:九成人只用到了它 10% 的能力。
它为「连续跑几天」而生,人们却只用几分钟。
2/ 真正的分水岭:自我学习 vs 自我改进
自我学习是模型改自己的权重,Fable 5 不做,目前没有量产模型做。
自我改进是模型外面的系统在复利:每次运行把教训写进记忆,技能越用越利。模型不变,环境每跑一次都更聪明。
3/ 把复利栈从底往上搭四层
底层是原语:Fable 5、子智能体、worktree,多数人只碰到这层。 第二层是编排:目标循环、动态工作流、云端 Routines。 第三层是记忆:状态文件、Skills、知识库。 顶层是自我改进:视觉自检、评估循环、规则蒸馏。
4/ 别什么都丢给 Fable 5 跑
它每 token 约是 Opus 4.8 的 5 倍贵(10/百万输入、50/百万输出)。
让 Fable 5 当编排者,Sonnet 4.6 干量大的活,Haiku 4.5 当打分员,被安全分类器拦截时自动回退 Opus 4.8。
5/ 永远别让模型给自己打分
Anthropic 自己的实验:带独立验证者的版本敢做更大改动,硬把一次失败的实验推到最大胜果;自己打分的版本只敢微调一个安全参数,早早收手。
写代码的智能体,永远不该是给它打分的那个。
6/ 记忆的五个阶段:失败→调查→验证→蒸馏→查阅
Sonnet 4.6 多半停在第一步,堆一堆没人再看的失败笔记。 Fable 5 能走完全程,最强时验证覆盖率冲到 70% 多,把事实蒸馏成可复用规则。
差距不在模型,在你有没有状态文件。
7/ 自我改进是系统的属性,不是模型的
每个证明这点的实验里,两边的模型一模一样。变的是外面的系统:验证者、状态文件、评估循环。
挑一层你还没做的,明天就加上,然后加下一层。
阅读原文:
以上就是全部
如果您喜欢这个主题:
1.关注我(@FinanceYF5) 2. 点赞+转发下面第一条帖子
1/ a16z 一周四张图:AI 正在重新定价一切
制造业回流、美国人喝酒、搜索点击、SaaS 股价,四件看似无关的事,指向同一个分化。
讲不出 AI 故事的,都在被甩开。
相似文章
@FinanceYF5: 天啊……Fable 5 回来了,而且强得离谱。 有人让 Fable 做了一款叫《超级智能竞速赛》的游戏…… 只用了 4 个提示词,花了价值 173 美元的 token,Fable 5 就做出了这个游戏。(提示词在下方)
Fable 5 模型仅通过4个提示词和173美元token就制作了一款名为《超级智能竞速赛》的游戏,展示了极强的生成能力。
@FinanceYF5: 1/ 有人用 Fable 5 跑了 3 个任务。 $200 的 Max 会员,5 小时额度干没 73%。 他说懵了。不是因为贵——是因为 Opus 4.8 从来没干出过这种东西。 一个 Thread 讲清楚
用户使用Fable 5模型运行3个任务,耗尽了Max会员5小时额度的73%,对比Opus 4.8从未如此消耗资源,引发讨论。
@Saccc_c: Fable 5 续命了,这4个方向你值得尝试: 1、用 Fable 5 复刻任何好用但需付费的软件 2、用 Fable 5 检查你与Claude所有的聊天记录、日常工作流和项目记忆,将关键经验、流程沉淀为可复用的skill和工作模版 3、…
Fable 5 的新功能提供了四个实用方向:复刻付费软件、沉淀聊天记录为技能模板、审核项目并迭代、探索复杂功能原型设计。
@yibie: 推荐这篇文章,Superpowers 的作者让 Fable 5 跑了一个完整的 autoresearch loop——25 个实验,$165,把构建速度提高了 50%、token 开销降低了 60%。但这篇最值钱的不是结果数字,是他完整记…
Superpowers 6 发布,利用 Fable 5 进行 25 个自治实验,将构建速度提高 50%、token 开销降低 60%,并详细记录了实验过程和失败教训。
@RookieRicardoR: Fable 5 Max,五个任务,3300 代码,跑了 90 分钟,这对吗?
讨论了Fable 5 Max的运行情况(五个任务,3300行代码,90分钟),并指出使用Claude Code最新版本(170)时Fable 5的消耗是Ops 4.8的两倍。