立场:科学团队中的AI代理应作为人-代理系统来研究

Hugging Face Daily Papers 论文

摘要

本文立场论文认为,科学团队中的AI代理应作为人-代理系统来研究,以增强协作并缓解风险,例如科学探究中多样性的减少。

基于大型语言模型的代理越来越多地被部署为科学发现的协作者,然而当前大多数工作集中在“AI科学家”的自主能力上。我们认为,这忽略了科学团队的社会方面,并且将AI科学家作为人-代理系统(HAS)来研究——其中分析单位是人-代理对——既未被充分探索,也未被充分重视。我们通过文献和实证分析来确立这些观点,并强调近期的一些事件和研究表明,在科学中部署代理而不考虑人-代理动态会引入近期风险,包括科学探究多样性的减少。通过对现实案例的分析,我们表明科学家和代理可以增强彼此的能力。我们呼吁开展新的研究,采用HAS视角来开发数学框架,以理解和促进科学发现中的人-AI协同。
查看原文
查看缓存全文

缓存时间: 2026/08/18 03:51

论文页面 - 定位:科学团队中的AI智能体应作为人机系统来研究

来源:https://huggingface.co/papers/2608.14667
发布于8月2日

·

由https://huggingface.co/LeoYML提交

Leo Y (https://huggingface.co/LeoYML)于8月18日

作者:

,

,

,

,

,

,

,

,

,

,

,

摘要

与AI智能体开展科学协作需要研究人机对组,以避免研究多样性降低等风险,并促进协同发现。

基于大语言模型的智能体(https://huggingface.co/papers?q=Large%20language%20model-based%20agents)正越来越多地作为科学发现的协作者被部署,但当前大多数研究聚焦于“AI科学家“(https://huggingface.co/papers?q=AI%20Scientists)的自主能力。我们认为,这种视角忽视了科学团队协作的社会性维度,将AI科学家(https://huggingface.co/papers?q=AI%20Scientists)作为人机系统(https://huggingface.co/papers?q=human-agent%20systems)(HAS)来研究——即以人机对组为分析单元——既未被充分探索,也未受到足够重视。本文通过文献分析与实证研究论证这些观点,并指出近期案例与研究表明:若忽视人机动态(https://huggingface.co/papers?q=human-agent%20dynamics)而部署科研智能体,将带来近期风险,包括科学探索多样性的降低。通过现实案例的分析,我们展示了科学家与智能体如何相互增强能力。我们呼吁开展新研究,以人机系统视角建立数学框架,理解并促进科学发现中的人机协同(https://huggingface.co/papers?q=human-AI%20synergy)。

查看arXiv页面(https://arxiv.org/abs/2608.14667)查看PDF(https://arxiv.org/pdf/2608.14667)添加至收藏夹(https://huggingface.co/login?next=%2Fpapers%2F2608.14667)

引用本文的模型 0

无模型链接本文

在模型README.md中引用arxiv.org/abs/2608.14667,即可从本页面链接该模型。

引用本文的数据集 0

无数据集链接本文

在数据集README.md中引用arxiv.org/abs/2608.14667,即可从本页面链接该数据集。

引用本文的空间 0

无空间链接本文

在空间README.md中引用arxiv.org/abs/2608.14667,即可从本页面链接该空间。

包含本文的收藏夹 0

无收藏夹包含本文

将本文添加至收藏夹(https://huggingface.co/new-collection),即可从本页面链接该收藏夹。

相似文章

人工智能评估应与人类协作

arXiv cs.AI

这篇立场论文主张,人工智能评估应转向评估人机团队,而非超人类性能,以促进更好的社会成果。

AgentPanel:迈向人机协作探索科学问题的新范式

arXiv cs.AI

AgentPanel 是一个用于科学探索中人机协作的多代理论坛系统,使异构代理能够异步讨论研究问题。评估表明,它优于集中式多代理辩论,并且 65% 的参与者更倾向于使用它进行早期探索。

AI安全需要社会科学家

OpenAI Blog

OpenAI主张AI安全研究中的价值对齐需要社会科学家的帮助,以解决人类认知偏差和不一致如何影响用于训练AI系统的数据的问题。该组织提议通过仅涉及人类的实验方法来发现对齐问题,然后再部署机器学习解决方案。