@omarsar0: // Scaling Laws for Agent Harnesses // 如果你构建代理框架,这篇文章值得一看。(收藏)大多数 harness…
摘要
关于代理框架缩放定律的新研究显示,大多数字令和工具调用次数并不重要;该研究引入了一种有效的方法。
// Scaling Laws for Agent Harnesses //
如果你构建代理框架,这篇文章值得一看。
(收藏)
大多数框架调优将每个令牌和工具调用视为数量决定一切。新研究表明,其中大部分并不重要。
该研究引入了有效的方法 https://t.co/SDT2ZVUuuW
查看缓存全文
缓存时间: 2026/05/30 02:01
// 智能体框架的缩放定律 //
如果你构建智能体框架,这篇文章值得一读。
(收藏它)
大多数框架调优将每个 token 和工具调用视为数量至上。新研究表明,大多数情况并非如此。
这项工作引入了 Effective https://t.co/SDT2ZVUuuW
相似文章
@Xudong07452910: 这篇最新的论文 Scaling Laws for Agent Harnesses 很适合做 Agent Harness 的人看。 它讲了一个很关键的点:Agent 不是靠多跑 token、多调工具、多循环几轮就一定变强。真正重要的是,这些…
这篇论文提出了 Effective Feedback Compute (EFC) 作为衡量 Agent Harness 性能的缩放坐标,强调有效反馈比原始计算量更重要,对 Agent 系统设计有重要启示。
@omarsar0:强烈推荐。我经常声称构建agent harnesses有巨大的alpha收益。结果发现harnesses是组合…
讨论了agent harnesses作为组合通用器的概念,用于模型中扩展泛化能力,并引用了RLM harness。
@omarsar0: // 自我束具:能自我改进的束具 // (收藏这个)我们今天依赖的大多数智能体框架…
本文介绍了自我束具(Self-Harness),一种新的范式,其中基于LLM的智能体能够迭代地改进自身的操作束具——包括提示、工具和控制流程——无需人类工程师或更强大的外部智能体,在多个模型上取得了显著的性能提升。
@omarsar0: 构建并拥有你的工具,各位。很少有人理解定制和优化智能体工具背后的魔力…
该推文强调构建自定义AI智能体工具以优化性能,提到了Pi的应用,并讨论了自我改进算法和本地模型,以实现更好的控制和效率。
@omarsar0:大家,构建你自己的框架。这是来自NVIDIA关于自进化代理框架的绝佳论文。(收藏它…)
论文介绍了SoL-Pi,一种自动化框架发现方法,可将token使用量减少近一半,并将API成本削减约三分之一,同时在基准测试中保持性能,使用诸如GPT-5.6 Sol和Opus 5的模型。