Harness-Zero:通过Agent-as-Harness的Harness蒸馏
摘要
本文介绍了Harness-Zero,一种通过agent-as-harness将优化的代理框架蒸馏到大语言模型中的方法,即使在专业框架被移除后,也能显著提升知识工作、工具使用和科学领域的任务性能。
查看缓存全文
缓存时间: 2026/09/22 07:27
论文页面 - Harness-Zero:通过智能体作为约束器实现约束蒸馏
来源:https://huggingface.co/papers/2609.24974
摘要
智能体约束器(Agentharnesses)作为中介模型与环境交互的外部系统,能显著提升智能体性能,但其优势始终依赖于部署时所用的约束器。由于最优约束器因领域、实例和模型而异,通用智能体要么满足于次优的共享约束器,要么在不断增长的专用约束器集合间切换。因此,我们研究智能体约束蒸馏:将针对特定领域或实例优化的约束器作为训练时引导,并将其诱导的行为迁移到模型权重中,使其优势在单一固定目标约束器下得以保留。挑战在于两种约束器在动作空间和可用信息上存在差异,因此优化约束器的引导无法直接作为目标约束器的监督信号。我们提出 Harness-Zero,通过“智能体作为约束器”的方式实现约束蒸馏。在优化约束器的引导下,约束智能体在目标约束器的动作空间中对学生产出进行执行前纠正,将约束引导转化为训练演示。基于生成轨迹的微调将约束诱导行为内化到模型中,从而在部署时可移除专用约束器。我们在知识工作、工具使用和科学领域的实验表明:(1) 对于使用相同进化约束器的前沿大语言模型,智能体作为约束器优于代码作为约束器。(2) 部署时移除专用约束器后,Harness-Zero 将基础模型的宏平均任务成功率从 23.3% 提升至 44.3%,甚至超过保留该约束器时达到的 41.7%。(3) Harness-Zero 能恢复基础模型中缺失的约束诱导行为,在三个领域的 28 种模式中平均恢复率达 82.3%。
查看 arXiv 页面 (https://arxiv.org/abs/2609.24974) 查看 PDF (https://arxiv.org/pdf/2609.24974) GitHub1 (https://github.com/metaevo-ai/harness-zero) 添加到收藏 (https://huggingface.co/login?next=%2Fpapers%2F2609.24974)
在您的智能体中获取此论文:
hf papers read 2609.24974
没有最新 CLI?curl \-LsSf https://hf\.co/cli/install\.sh \| bash
引用此论文的模型 0
没有模型链接此论文
在模型 README.md 中引用 arxiv.org/abs/2609.24974 以从本页链接。
引用此论文的数据集 0
没有数据集链接此论文
在数据集 README.md 中引用 arxiv.org/abs/2609.24974 以从本页链接。
引用此论文的空间 0
没有空间链接此论文
在空间 README.md 中引用 arxiv.org/abs/2609.24974 以从本页链接。
包含此论文的收藏 0
没有收藏包含此论文
将此论文添加到收藏 (https://huggingface.co/new-collection) 以从本页链接。
相似文章
Harness作为语言:一个极简代理框架,具备最大表达能力
论文介绍了JAZ,一个极简代理框架,它使用单一的调用原语使LLM代理能够处理长期任务和自我改进,无需外部工具,并在评估中超越了MemGPT和ACE等现有系统。
HarnessX:可组合、自适应且可演进的智能体夹具工坊
HarnessX 是一个为可组合、自适应且可演进的人工智能智能体夹具打造的工坊,它利用组合原语和轨迹驱动演化来提升智能体性能。在五项基准测试中,它平均提升了 +14.5%(最高达 +44.0%),表明运行时接口演化是模型规模扩展之外的一个互补杠杆。
最好的智能代理工具会这样做……
作者分享了构建高效智能代理工具的见解:最好的工具最大限度地减少对大语言模型(LLM)在琐碎任务上的依赖,将其保留用于复杂推理,从而将真正的代理工具与简单的包装器区分开来。
@dair_ai: // 状态外部化框架 // 关于如何有效构建代理和框架的一种新范式正在兴起。如果……
Harness-1 引入了一种状态外部化框架,将常规记账与搜索代理中的策略决策分离,使一个 20B 模型在多个基准测试中超越更大的前沿搜索器。
@omarsar0: // 自我束具:能自我改进的束具 // (收藏这个)我们今天依赖的大多数智能体框架…
本文介绍了自我束具(Self-Harness),一种新的范式,其中基于LLM的智能体能够迭代地改进自身的操作束具——包括提示、工具和控制流程——无需人类工程师或更强大的外部智能体,在多个模型上取得了显著的性能提升。