@tom_doerr: 生成96,000条高质量深度研究轨迹,并提供完全开源的配方,用于训练代理型语言模型…
摘要
OpenResearcher是来自TIGER-AI-Lab的一个开源项目,它提供了96,000条深度研究轨迹以及一套无需外部API即可训练代理型语言模型进行长周期网络研究的方案。它包含数据集、模型和演示,并已被NVIDIA的Nemotron模型采用。
生成96,000条高质量深度研究轨迹,并提供完全开源的方案,用于训练代理型语言模型在长周期网络研究任务上,无需外部API依赖。
https://t.co/zUo5XOpZBb https://t.co/HmfzWXxrHO
查看缓存全文
缓存时间: 2026/07/15 19:59
🤗 HuggingFace | Slack | 微信
↑ 返回顶部 ↑
相似文章
@tom_doerr:开源长周期深度研究智能体 https://github.com/TIGER-AI-Lab/OpenResearcher…
TIGER-AI-Lab 发布 OpenResearcher,一款用于自动化长周期深度研究任务的开源智能体。
OpenResearcher: 面向长周期深度研究轨迹合成的全开放流水线
OpenResearcher 提出了一种可复现的流水线,用于使用离线搜索环境和合成轨迹训练深度研究智能体,在 BrowseComp-Plus 等基准任务上实现了显著的准确率提升。
S1-DeepResearch:超越搜索,迈向真实世界的长周期研究代理
本文介绍了S1-DeepResearch-32B,这是一个开源模型及包含15K条轨迹的数据集,用于深度研究代理,通过联合建模信息获取、知识综合与规划,在20个基准测试中取得了最先进的性能。
@trendtech33566: 【突发新闻】一款完全以开放方式复现Deep Research工作流程的开源软件(OSS)已出现——OpenResearcher……
OpenResearcher是一个开源项目,它完全复现了Deep Research的工作流程,并提供了数据集、模型和演示。它使研究人员和AI智能体开发者能够以开放的方式构建、训练和评估深度研究管道。
@tom_doerr: 完全开源 30B 规模搜索智能体的训练数据 https://github.com/PolarSeeker/OpenSeeker…
OpenSeeker 完全开源了基于 ReAct 框架的 30B 规模搜索智能体的训练数据与模型,在多个基准测试(包括 BrowseComp 和 Humanity's Last Exam)上达到了最先进的性能。这是首个在前沿搜索基准上达到顶尖水平并同时公开完整训练数据的纯学术项目。