ScienceBuddy: 面向交互式科学代理的递归中递归自我改进
摘要
ScienceBuddy 引入了一种递归中递归的自我改进范式,用于交互式科学代理,通过研究员合作与反馈实现持续演进。
查看缓存全文
缓存时间: 2026/09/16 02:45
论文页面 - ScienceBuddy:面向交互式科学智能体的递归套递归自我改进
来源:https://huggingface.co/papers/2609.17523 发布于 9月15日
#2 当日最佳论文 (https://https://huggingface.co/papers/date/2026-09-16) 作者:
,
,
,
,
,
,
,
,
,
,
,
摘要
我们介绍并发布了ScienceBuddy,这是一个交互式科研工作空间,旨在将持续自我改进的科学智能体融入研究人员的日常工作流程。ScienceBuddy帮助研究人员执行科学任务,并将其请求、反馈和执行证据转化为用于持续学习的任务和评估标准。其核心是递归套递归自我改进范式,该范式将工具进化与模型强化学习相结合:内部递归在固定模型下改进工具,外部递归则在改进后的工具下训练模型。工具进化塑造训练经验,而模型学习又为工具适应创造了新的机会。我们展示了研究人员交互、工具优化和模型学习的案例研究,其中基准测试覆盖了四个科学任务家族。通过将ScienceBuddy作为研究产品发布,我们使这一范式可供科学界使用,并迈向发现智能的目标:通过与研究人员的持续协作不断进步,并与支撑的研究共同演化的科学人工智能。网站:http://science-buddy.io
查看 arXiv 页面 (https://arxiv.org/abs/2609.17523) 查看 PDF (https://arxiv.org/pdf/2609.17523) 项目页面 (http://science-buddy.io/) GitHub5 (https://github.com/Gen-Verse/ScienceBuddy) 添加到收藏 (https://huggingface.co/login?next=%2Fpapers%2F2609.17523)
引用此论文的模型 0
没有模型链接此论文
在模型的 README.md 中引用 arxiv.org/abs/2609.17523 即可从本页链接。
引用此论文的数据集 0
没有数据集链接此论文
在数据集的 README.md 中引用 arxiv.org/abs/2609.17523 即可从本页链接。
引用此论文的空间 0
没有空间链接此论文
在空间的 README.md 中引用 arxiv.org/abs/2609.17523 即可从本页链接。
包含此论文的集合 0
没有集合包含此论文
将此论文添加到集合 (https://huggingface.co/new-collection) 即可从本页链接。
相似文章
递归自我改进的首个实验证据(3分钟阅读)
研究人员展示了AIDE²,这是一个具有递归自动研究循环的系统,在超过100次迭代中改进了自己的代码,发现了七项改进,并在保留的基准测试上击败了手动调优的智能体。
AI研究智能体的递归自我改进
本文介绍了AIDE^2,这是一个系统,它使AI研究智能体能够通过递归自我改进自主提升其代码,从而在多种AI研究任务中获得性能提升。
递归自我改进的经济学 [pdf]
本文探讨了AI系统中递归自我改进的经济激励和动态,分析了此类过程如何扩展及其对治理与安全的影响。
AI中的递归自我改进:从有界自我优化到自主研究循环
对2024–2026年间1,250篇关于AI递归自我改进的论文进行了全面综述,提出了将有界自我优化与开放式递归自我改进相区分的分类体系,并分析了评估器设计空间和失败模式。
AREX:迈向递归自我改进的深度研究代理
AREX 引入了一系列用于深度研究的递归自我改进代理,在内层研究循环和外层自我改进循环之间交替,并通过长周期强化学习进行训练。在 BrowseComp 和 Humanity's Last Exam 等基准测试中,其表现大幅优于同量级基线模型。