@boringmarketer: 如果你想立刻获得Fable级别的性能,答案就是构建你自己的编程脚手架。以下是我的做法(以一种轻量级的方式……
摘要
一份关于使用Pi、Codex和OpenRouter构建个人编程脚手架的指南,旨在无需重型框架即可实现顶尖的尖端性能。
查看缓存全文
缓存时间: 2026/06/15 19:08
如果你现在就想达到 Fable 级别的性能,答案就是自己搭建一个编码工具链。
我是这样做的(采用轻量级、Pi 原生的方式,而不是笨重的 Superpowers/Compound 克隆方案)。
首先,我认为我们会看到个人工具链的出现,它们能降低对单一模型的依赖风险,帮助用户省钱,并从自研系统中榨出顶尖的 frontier 性能。
我认识的最优秀的工程师已经在这么做了……
- 使用 Pi,这个开源的编码工具链,你可以自定义它并接入任意模型。
- 将 5.5 codex 设为默认模型。
- 深入分析公开可用的系统提示词(猜猜我看的是哪个模型?)。
- 向 Codex 提供关于 Loop Engineering 及其他工程技能仓库的上下文。
- 让它提高效率——因为很多工程仓库都过于庞大、臃肿且缓慢。
- 让它通过 Openrouter 使用 FUSION 来规划、逻辑推理和审查任务。
- 让它使用 Kimi k2.7 code 来运行子代理/执行任务。
- 让它自行测试这套工具链,直到调优到位,然后在一个仓库上深度分析。
很好!
非常酷,我会去试试!
相似文章
构建自己的智能体框架 VS 使用现有智能体框架(如Claude Code)
作者质疑像Claude Code这样的单体式智能体编码工具的效率,认为一个按阶段路由模型的自定义框架可以在不牺牲质量的情况下降低成本,并向社区询问他们的经验和建议。
最喜欢的代理式编码工具
作者比较了几种代理式编码工具(Codex CLI、Claude Code、Gemini CLI、OpenCode、Pi),认为Pi最精简且最适合本地模型,赞赏其简洁性以及与Qwen 27B-MXFP8的兼容性。
在同一个工具集中跨 Claude Code、Codex 和 Ollama 路由编码智能体会话——按会话挑选模型
一位开发者描述了如何构建一个多引擎智能体编码工具集,在 Claude Code、Codex 和 Ollama 之间路由会话,并根据任务价值为每个会话从十二个模型中进行选择。
@sethkarten: https://x.com/sethkarten/status/2072034978112889328
Continual Harness 是一种无需重置、自我改进的智能体框架,通过存储记忆、复用技能和优化提示,在 ARC-AGI-3 上以 774 美元的成本达到了 20.54% 的准确率,以更高的效率超越了 Hermes 和 OpenClaw 等先前基准。
@joelniklaus: 关于框架优化的新博客文章。我们以成本降低 7 倍达到了 Sonnet 4.6 的性能。Fable 5 是第一个……
一篇博客文章描述了自动框架优化如何使 DeepSeek V4 Pro 在法律代理基准测试上以七分之一的成本达到 Sonnet 4.6 的性能。