tree-search

标签

Cards List
#tree-search

针对预算受限代理搜索的更充分利用与更智能探索

arXiv cs.AI · 2026-08-26 缓存

本文介绍了ExTS,这是一种针对LLM代理中预算受限代理搜索的树搜索策略,在提示优化和代码生成等任务中,相比标准基线平均提升5.5%。

0 人收藏 0 人点赞
#tree-search

Recovering Wasted Compute in Autoresearch Agents

arXiv cs.AI · 2026-08-12 缓存

This paper identifies common failure modes in tree-search-based autoresearch agents applied to tabular datasets, such as repeated bug resolution, poor hyperparameter tuning, and ineffective exploration, and proposes targeted interventions like a global debug consultant and refined tree-search algorithms to recover wasted compute and improve performance without changing the underlying language model.

0 人收藏 0 人点赞
#tree-search

@dair_ai: Very cool idea to have agents design complex systems by searching over the model structure itself. New research from Sa…

X AI KOLs Timeline · 2026-08-10 缓存

A tweet from DAIR AI highlights new research by Sakana AI introducing CEDAR, an LLM-agent method that designs, simulates, and refines complex system-dynamics models via Monte Carlo Tree Search over feedback structures, aiming to automate goal-directed design in artificial life.

0 人收藏 0 人点赞
#tree-search

SkillHEX:通过假设驱动的自主探索与利用提升智能体技能

arXiv cs.AI · 2026-08-07 缓存

SkillHEX提出了一种用于大语言模型智能体自主技能演化的闭环框架,利用假设驱动的自我验证和证据引导的树搜索来克服稀疏奖励挑战。在有限交互预算下,它在SkillsBench上优于现有自演化方法。

0 人收藏 0 人点赞
#tree-search

GATS:基于图增强的树搜索与分层世界模型的高效智能体规划

arXiv cs.AI · 2026-07-13 缓存

GATS引入了一种基于图增强的树搜索与分层世界模型(符号型、学习型、生成型),消除了规划过程中的LLM调用,在合成任务和压力测试中实现了100%的成功率,优于LATS和ReAct。

0 人收藏 0 人点赞
#tree-search

三思而后行:将树搜索蒸馏为冻结VLA模型的动作评估

Hugging Face Daily Papers · 2026-07-04 缓存

提出了SVA框架,该框架在冻结的VLA模型中将动作生成与后果评估解耦,使用蒙特卡洛树搜索并将其蒸馏为轻量级Q值模型,从而提升泛化能力和任务成功率,同时降低计算成本。

0 人收藏 0 人点赞
#tree-search

SproutRAG: 面向长文档RAG的注意力引导树搜索与渐进式嵌入

arXiv cs.CL · 2026-06-18 缓存

SproutRAG是一种层次化RAG框架,利用注意力引导的树搜索和渐进式嵌入,从长文档中实现多粒度检索,相较于基线方法将信息效率提升了6.1%。

0 人收藏 0 人点赞
#tree-search

LLMZero:通过LLM智能体发现强化学习后训练的自适应训练策略

arXiv cs.LG · 2026-06-18 缓存

LLMZero利用LLM智能体通过树搜索在训练轨迹中进行搜索,发现用于强化学习后训练的自适应多参数过渡策略,该策略在多种任务中优于固定调度和网格搜索。

0 人收藏 0 人点赞
#tree-search

@umichkim: AI for Science 正从“写文本”转向“写和测试科学代码”。一篇新的 Nature 论文介绍了 ER…

X AI KOLs Timeline · 2026-06-16 缓存

一篇新的 Nature 论文介绍了 ERA,这是一种通过树搜索迭代编写、运行、评分和改进科学代码的 AI 系统,将 AI for Science 从文本生成推进到代码测试。

0 人收藏 0 人点赞
#tree-search

@omarsar0: // OpenClaw-Skill: 搜索智能体技能树 // 如果你为智能体构建可复用的技能库,这篇值得一看…

X AI KOLs Following · 2026-06-16 缓存

本文介绍了集体技能树搜索(CSTS)这一框架,它利用多个模型的集体智慧,为LLM智能体构建结构化、多样且可泛化的技能树。由此产生的模型OpenClaw-Skill在长程规划、工具使用和泛化能力方面展现了更优的智能体性能。

0 人收藏 0 人点赞
#tree-search

StarOR: 协同树搜索与测试时强化学习的优化建模

arXiv cs.LG · 2026-06-16 缓存

StarOR 提出了一种框架,将蒙特卡洛树搜索与测试时强化学习协同用于自动优化建模,在多个基准测试中取得了最先进的性能。

0 人收藏 0 人点赞
#tree-search

Arbor:树搜索作为自主代理的认知层

arXiv cs.AI · 2026-06-12 缓存

Arbor 引入了结构化树搜索作为自主代理的认知层,通过制衡多代理架构,实现多日、全栈 LLM 推理优化,相比供应商基线,吞吐量-延迟提升高达 193%。

0 人收藏 0 人点赞
#tree-search

MLEvolve:自动化机器学习算法发现的自我进化框架

Hugging Face Daily Papers · 2026-06-04

MLEvolve是一个基于LLM的自我进化多智能体框架,用于自动化机器学习算法发现。它将树搜索扩展为Progressive MCGS,并引入基于图的跨分支信息流和Retrospective Memory。该框架在MLE-Bench上取得了最先进的性能,并在数学算法优化任务上优于AlphaEvolve。

0 人收藏 0 人点赞
#tree-search

树上的智能体:面向多目标分子优化的路径协调

arXiv cs.AI · 2026-06-02 缓存

ATOM是一个多智能体框架,将分子优化建模为树状搜索,沿路径布置专门化的智能体,从而能够探索替代分子轨迹并在多目标基准测试中提高帕累托覆盖率。

0 人收藏 0 人点赞
#tree-search

基于强化学习的智能体Transformer可证明地学会搜索

arXiv cs.LG · 2026-06-02 缓存

本文从理论上研究了基于Transformer的策略如何从随机树环境中的强化学习训练动态中获得搜索能力。研究表明,一个双头Transformer可以实现深度优先搜索,并且在深度分阶段课程下,这种机制会自然地从稀疏奖励信号中涌现。

0 人收藏 0 人点赞
#tree-search

重根Levin树搜索中的结构诱导信息

arXiv cs.AI · 2026-06-01 缓存

本文针对Levin树搜索提出了三种重根器设计,利用状态空间结构和学习启发式方法,无需显式子目标生成即可提升搜索效率,实现了当前最优的在线训练效率。

0 人收藏 0 人点赞
#tree-search

随机极小极大树的双保真度最优动作识别

Hugging Face Daily Papers · 2026-06-01 缓存

本文提出了2FFS,一种双保真度树搜索算法,该算法在随机极小极大树中自适应地平衡廉价但有偏差的评估与昂贵但准确的评估,用于固定置信度的最优动作识别,具有理论保证和实验效率提升。

0 人收藏 0 人点赞
#tree-search

@lateinteraction: 非常酷的工作!!

X AI KOLs Timeline · 2026-05-29 缓存

Guowei Xu 讨论了 Best-of-N 和树搜索方法在 LLMs 处理困难推理问题时的局限性,指出验证信号稀疏且候选答案仍处于模型的分布范围内。

0 人收藏 0 人点赞
#tree-search

MAPLE: 不完全信息游戏中AlphaZero的多状态聚合策略评估

arXiv cs.AI · 2026-05-26 缓存

本文介绍了MAPLE,一种树搜索方法,它聚合来自多个采样子世界状态的策略和价值评估,将AlphaZero扩展至不完全信息游戏。在Phantom Go和Dark Hex上的实验显示,与基于PIMC的AlphaZero基线相比,Elo分别提升了291和136。

0 人收藏 0 人点赞
#tree-search

从多模态经验中学会学习

arXiv cs.AI · 2026-05-19 缓存

本文介绍了AutoMMemo,一个使多模态智能体能够自动设计记忆机制(可表达为可执行的备忘录程序)以从多模态交互轨迹中学习的框架,在GUI/Web导航和视觉推理基准上优于无记忆和固定记忆基线。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈