Looped语言模型改进组合工具调用

Hugging Face Daily Papers 论文

摘要

Looped语言模型通过利用循环计算来增强组合工具调用,在多步任务中提高准确性,同时自适应推理优化了性能和计算成本之间的平衡。研究表明,这些模型对于可靠的智能体系统很有前景。

Looped语言模型在推理基准测试上显示出了有希望的结果,但其在智能体工具使用方面的潜力在很大程度上尚未探索。我们在组合工具调用环境中研究这个问题,其中模型必须协调多个API调用、维护中间状态并保持工具交互之间的依赖关系。我们在API-Bank、BFCL和NESTful上评估了原生和改装的Looped语言模型,比较了在匹配的监督微调方案下训练的循环和非循环模型,以及在推理时变化的循环深度。在受控实验中,循环计算通常有益于组合和依赖感知的工具使用,而在孤立的API调用上提供较小且更依赖模型的增益。多步工具使用的准确性通常随循环深度增加而提高;然而,自适应推理通过仅在需要时分配额外计算,实现了更优的计算性能权衡。我们的结果表明,Looped语言模型是智能体系统的一种有前景的架构,这些系统需要可靠的规划、协调和执行组合工具使用工作流。
查看原文
查看缓存全文

缓存时间: 2026/08/20 04:03

论文页 - 循环语言模型提升组合式工具调用能力

来源:https://huggingface.co/papers/2608.18171

摘要

循环语言模型通过循环计算,能更有效地进行组合式、多步骤的工具调用,同时通过自适应推理平衡准确性与计算成本。

循环语言模型 (https://huggingface.co/papers?q=Looped%20language%20models) 在推理基准测试上展现出良好潜力,但其在智能体工具调用方面的潜力仍很大程度上未被探索。我们在组合式工具调用 (https://huggingface.co/papers?q=compositional%20tool-calling) 场景下研究这个问题。在此类场景中,模型需要协调多次 API 调用、维护中间状态,并在工具交互过程中保持依赖关系。我们在 API-Bank (https://huggingface.co/papers?q=API-Bank)、BFCL (https://huggingface.co/papers?q=BFCL) 和 NESTful (https://huggingface.co/papers?q=NESTful) 上评估了原生和改造后的循环语言模型 (https://huggingface.co/papers?q=looped%20language%20models),对比了在匹配的监督微调策略下训练的循环与非循环模型,并考察了推理时不同循环深度 (https://huggingface.co/papers?q=recurrent%20depth) 的影响。在受控实验中,循环计算通常对组合式、感知依赖的工具调用有益,而对孤立的 API 调用则带来较小且因模型而异的增益。多步骤工具调用 (https://huggingface.co/papers?q=multi-step%20tool%20use) 的准确性通常随循环深度 (https://huggingface.co/papers?q=recurrent%20depth) 增加而提高;然而,自适应推理 (https://huggingface.co/papers?q=adaptive%20inference) 通过仅在需要时分配额外计算,实现了更优的计算性能权衡。我们的结果表明,循环语言模型 (https://huggingface.co/papers?q=looped%20language%20models) 是智能体系统 (https://huggingface.co/papers?q=agentic%20systems) 的一个有前途的架构,这些系统需要可靠的规划、协调以及组合式工具使用工作流的执行。

查看 arXiv 页面 (https://arxiv.org/abs/2608.18171)查看 PDF (https://arxiv.org/pdf/2608.18171)添加到收藏 (https://huggingface.co/login?next=%2Fpapers%2F2608.18171)

在您的智能体中获取此论文:

hf papers read 2608\.18171

没有最新的 CLI?curl \-LsSf https://hf\.co/cli/install\.sh \| bash

引用此论文的模型0

暂无模型链接此论文

在模型的 README.md 中引用 arxiv.org/abs/2608.18171 以从本页链接。

引用此论文的数据集0

暂无数据集链接此论文

在数据集的 README.md 中引用 arxiv.org/abs/2608.18171 以从本页链接。

引用此论文的空间0

暂无空间链接此论文

在空间的 README.md 中引用 arxiv.org/abs/2608.18171 以从本页链接。

包含此论文的收藏集0

暂无收藏集包含此论文

将此论文添加到收藏集 (https://huggingface.co/new-collection) 以从本页链接。

相似文章

循环语言模型中循环计算的分配

arXiv cs.LG

本文介绍了MixerLoop,一种通过选择性循环语言模型中的混合器组件同时仅应用一次前馈网络来分配循环计算的方法,以在降低计算成本的同时提升性能。

具有自适应退出状态选择的循环状态空间语言模型

arXiv cs.AI

本文探索了使用Mamba和混合Mamba-Transformer骨干网络的循环(递归)状态空间语言模型,表明其在推理任务上优于非循环基线,并在等参数和等FLOPs预训练下保持竞争力,同时自适应退出状态选择改善了中间深度性能。

递归语言模型

Papers with Code Trending

本文介绍了递归语言模型(Recursive Language Models, RLMs),这是一种推理策略,使大型语言模型(LLMs)能够通过将任意长的提示视为外部环境,并在提示片段上递归调用自身来处理这些提示。RLMs可以处理超出上下文窗口两个数量级的输入,并且在长上下文任务上以可比的成本优于基础LLMs。

Looped World Models

Hugging Face Daily Papers

Looped World Models 通过共享的Transformer块引入迭代潜在状态细化,实现了100倍的参数效率,同时根据预测复杂度自适应调整计算深度。