tool-augmented

标签

Cards List
#tool-augmented

ToolSciVer: 基于视觉工具增强强化学习的多模态科学声明验证

arXiv cs.CL · 2026-07-20 缓存

本文介绍了ToolSciVer,这是首个面向多模态科学声明验证(MSCV)的工具增强框架。该框架为视觉语言模型(VLM)配备了类型感知的视觉工具,并使用GRPO训练策略,在SciVer和MuSciClaims数据集上,跨多个模型家族实现了卓越性能。

0 人收藏 0 人点赞
#tool-augmented

基于多智能体协作推理与工具增强证据的城市区域画像

arXiv cs.AI · 2026-07-16 缓存

本文提出 UrbanAgent,一个将城市区域画像重新定义为基于推理的推断问题的智能体框架,利用多智能体协作推理和工具增强的证据检索。在全球城市数据集上的碳排放、GDP和人口估算任务中,该框架优于基线方法,R²平均提升8.1%。

0 人收藏 0 人点赞
#tool-augmented

LLM的快速、慢速与工具增强思维:综述

arXiv cs.CL · 2026-07-09 缓存

本文提出了一种LLM推理策略的分类法,沿着两个正交轴:快速与慢速思考、内部与外部知识,并综述了近期自适应推理方法。

0 人收藏 0 人点赞
#tool-augmented

工具增强型LLM代理在实际能源分析任务中的表现如何?

arXiv cs.AI · 2026-06-26 缓存

本文介绍了一项实证研究和基准测试,用于评估工具增强型LLM代理在实际能源分析任务上的表现,包含243个由专家策划的问题,涵盖市场数据检索、知识解读和定量建模。

0 人收藏 0 人点赞
#tool-augmented

大型语言模型作为优化器:直接方法与工具增强方法的调查及其性能前沿

arXiv cs.AI · 2026-06-16 缓存

本调查将基于LLM的优化分为三个范式——直接优化、工具增强优化和工具创建优化——并回顾了它们的性能前沿和局限性。

0 人收藏 0 人点赞
#tool-augmented

能力最小化作为一种安全原语:面向最小权限LLM代理的风险感知因果门控

arXiv cs.AI · 2026-06-15 缓存

本文提出风险感知因果门控(RACG),这是一种无需训练的机制,将最小权限原则应用于LLM代理的工具暴露,仅在授权和因果必要时暴露高风险工具,从而减少提示注入的攻击面。

0 人收藏 0 人点赞
#tool-augmented

Contract2Tool:学习前提与效果以实现可靠的工具增强型LLM代理

arXiv cs.AI · 2026-06-09 缓存

本文介绍了Contract2Tool,一个从工具元数据、文档和执行轨迹中自动推断轻量级工具契约(前提条件、效果、风险)的框架,为LLM代理实现可靠的因果工具过滤。实验表明,学习到的契约在下游多步骤代理任务中达到了接近黄金契约的性能,同时显著减少了token使用量。

0 人收藏 0 人点赞
#tool-augmented

ToolGate:面向工具增强型视觉语言代理的令牌高效预调用控制

arXiv cs.AI · 2026-06-03 缓存

ToolGate 是一个轻量级的外部控制器,能够预测在视觉语言代理中是否执行或跳过感知工具调用,从而将令牌成本降至基线的64%-69%,同时保持跨域设置下的准确性。

0 人收藏 0 人点赞
#tool-augmented

TADDLE: 一种用于检测有缺陷的LLM生成同行评审的工具增强代理

arXiv cs.AI · 2026-05-27 缓存

介绍了TADDLE,一种用于检测有缺陷的LLM生成同行评审的工具增强代理,以及一个包含50篇ICLR 2025论文的1800条评审的专家标注基准。该系统将检测分解为四个专门的分析工具,并使用两阶段半监督学习进行二元和多标签分类。

0 人收藏 0 人点赞
#tool-augmented

工具增强代理:闭环优化、仿真与建模编排

arXiv cs.AI · 2026-05-22 缓存

本文介绍了COSMO-Agent,一个工具增强的强化学习框架,用于训练LLM执行闭环CAD-CAE优化,迭代生成参数化几何体并运行仿真直到满足约束条件,并包含一个多约束奖励和新的行业对齐数据集。

0 人收藏 0 人点赞
#tool-augmented

工具总是有益的吗?学会自适应调用工具以实现双模式多模态大语言模型推理

arXiv cs.CL · 2026-05-20 缓存

介绍 AutoTool,一种自适应决定是否调用工具进行多模态大语言模型推理的模型,通过强化学习和双模式推理实现了显著的准确率和效率提升。

0 人收藏 0 人点赞
#tool-augmented

信号:用于智能体交互的轨迹采样与分流

Papers with Code Trending · 2026-04-01 缓存

本文提出了一种轻量级的、基于信号的框架,通过计算低成本指标来高效分流智能体交互轨迹,这些指标能识别出信息丰富的样本,且不影响在线智能体行为,在基准测试上实现了82%的信息率。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈