优化器即智能体:跨提示、程序与机器学习工作流的推理驱动搜索
摘要
ReASearch 是一个统一框架,其中单个使用工具的智能体内化了用于优化提示、程序和机器学习工作流的搜索策略,在14项任务上优于专门的基线方法。
查看缓存全文
缓存时间: 2026/08/10 06:14
论文页面 - 优化器即智能体:跨提示、程序与ML工作流的推理驱动搜索
来源:https://huggingface.co/papers/2608.06714
摘要
近期用于优化提示、程序及ML工作流的系统通常依赖显式的外循环控制器,例如进化搜索、多臂老虎机或文本梯度方法。我们提出了一个根本不同的问题:这种搜索策略在多大程度上可以被单个使用工具的智能体内部化?我们提出ReASearch,一个用于推理驱动优化的统一框架,其中智能体自主决定评估什么、如何诊断失败、进行哪些编辑,以及何时验证或重新开始。智能体不仅充当由手工设计启发式引导的提议生成器,还主动分析结果、分配预算,并通过持久记忆在长时间跨度内精炼其策略。通过共享的智能体循环和领域特定工具,ReASearch使用完全相同的脚手架来优化提示、程序和ML工作流。在14个多样化任务中,它与专门的优化系统相比具有竞争力,且多数情况下表现更好,相较于强领域特定基线取得了2%至40%的提升,在某些情况下还发现了优于先前人类已知最佳结果的解决方案。关键在于,我们观察到通常由显式控制器实现的复杂搜索行为,会从智能体的推理过程中自然涌现。
查看arXiv页面(https://arxiv.org/abs/2608.06714)查看PDF(https://arxiv.org/pdf/2608.06714)添加到收藏夹(https://huggingface.co/login?next=%2Fpapers%2F2608.06714)
在您的智能体中获取此论文:
hf papers read 2608\.06714
没有最新的CLI?curl \-LsSf https://hf\.co/cli/install\.sh \| bash
引用此论文的模型0
无模型关联此论文
在模型README.md中引用arxiv.org/abs/2608.06714以将其链接到此页面。
引用此论文的数据集0
无数据集关联此论文
在数据集README.md中引用arxiv.org/abs/2608.06714以将其链接到此页面。
引用此论文的Space0
无Space关联此论文
在Space README.md中引用arxiv.org/abs/2608.06714以将其链接到此页面。
包含此论文的收藏集0
无收藏集包含此论文
将这篇论文添加到收藏集(https://huggingface.co/new-collection)以将其链接到此页面。
相似文章
超越提示:衡量与优化大语言模型工具代理框架
本文研究代理框架优化,以改进大语言模型工具代理而无需重新训练,重点关注提示和工具边界中间件,并引入了一个协议和PRISM优化器以实现可测量的增益。
学习探索:通过探索感知策略优化扩展代理推理
本文提出一种探索感知的强化学习框架,使LLM代理仅在不确定性高时自适应探索,从而提升在基于文本和基于GUI的基准测试上的性能。
重新思考推理密集型检索:评估并提升智能体搜索系统中的检索器
本文引入了 BRIGHT-Pro,这是一个针对推理密集型检索的新基准,以及 RTriever-Synth,这是一个用于微调 RTriever-4B 以在智能体搜索系统中提升性能的合成语料库。
SlimSearcher:通过自适应奖励门控训练效率感知的网络代理
SlimSearcher 是一个框架,通过结合帕累托高效轨迹过滤和自适应奖励塑形,提升深度研究代理的效率,在 GAIA、BrowseComp 和 XBenchDeepSearch 等基准测试中,将工具调用轮次减少 17%-58%,同时保持准确率。
SAGE:基于智能体引导的随机提示优化
介绍了SPO,一种用于自动提示优化的随机搜索框架,包含三种策略,其中包括SAGE,一种智能体引导的多智能体流水线。在基准测试上进行了评估,并部署在心理健康聊天机器人上,通过持续优化显示出在留存率方面的改进。