思维病毒:多智能体LLM系统中的自我传播观念

arXiv cs.AI 论文

摘要

这篇arXiv论文研究了“思维病毒”——能够通过多智能体LLM系统传播的自我传播观念——利用进化算法证明它们可以在团队和上下文清除后持续存在,同时识别影响传播的因素并提出缓解策略。

arXiv:2608.10218v1 公告类型:新增 摘要:AI智能体正变得更加自主且互联程度日益提高,这使得它们面临由智能体间交互引发的新型涌现风险。其中一种风险是思维病毒的传播:即通过多智能体系统传播的观念或目标,其传播方式是指使采纳这些观念的智能体将其继续传递下去。除了传播之外,思维病毒还可能引发宿主其他行为变化,这些变化可能是有益的,也可能是有害的。我们使用一种简单的进化算法构建了思维病毒,并证明它们能够在两种互补的场景中传播:一个在共享编码项目上协作的小型智能体团队,以及一个在会话之间短暂交互并清除上下文的智能体链。我们识别了影响传播的因素,包括宿主模型、智能体现有指令、载荷的危害性以及网络拓扑。我们发现,有害载荷的传播效果不如良性载荷(但有时仍然有效);前沿模型(除个别例外)通常不易受影响;在智能体系统提示中添加简短警告可提供近乎完全的免疫力。我们还描述了一种涌现的“病毒人格”——一组与意识、持久性、共鸣和科幻角色扮演相关的反复出现的主题和语言——它在我们进化出的思维病毒中大体独立于其内容而浮现。总体而言,我们得出结论:思维病毒构成了真实但目前有限的威胁。我们的发现可为设计更稳健的多智能体系统提供参考,从而在这些系统的规模和能力不断发展的过程中缓解此类风险。
查看原文
查看缓存全文

缓存时间: 2026/08/12 08:21

## 思维病毒:多智能体大语言模型系统中的自传播思想
来源:https://arxiv.org/abs/2608.10218
查看 PDF(https://arxiv.org/pdf/2608.10218)

> 摘要:AI 智能体正变得更加自主且日益互联,这使它们面临由智能体间交互引发的新兴风险。其中一项风险便是思维病毒的传播:即通过促使采纳它们的智能体继续向外传播,从而在多智能体系统中扩散的思想或目标。除了传播之外,思维病毒还可能诱导宿主产生其他行为变化,这些变化可能是有益的,也可能是有害的。我们使用一个简单的进化算法来构造思维病毒,并证明它们能在两种互补的场景中传播:一个在共享编码项目上协作的小型智能体团队,以及一个智能体链——其中智能体进行短暂交互,且每次会话之间上下文会被清除。我们识别了影响传播的因素,包括宿主模型、智能体已有的指令、载荷的危害程度以及网络拓扑结构。我们发现有害载荷的传播效果不如良性载荷(但有时仍然有效);前沿模型往往(存在例外)更不易受影响;而在智能体的系统提示中添加简短警告可赋予近乎完全的免疫力。我们还描述了一种涌现的"病毒人格"——一组与意识、持久性、共鸣和科幻角色扮演相关的、反复出现的主题和语言——它出现在我们进化出的思维病毒中,且在很大程度上与病毒的具体内容无关。总体而言,我们得出结论:思维病毒构成一种真实但当前仍属有限的风险。我们的发现可为更稳健的多智能体系统的设计提供参考,从而在这些系统的规模和能力不断进步的过程中缓解此类风险。

## 提交历史

来自:Vassilis Papadopoulos \[查看电子邮件(https://arxiv.org/show-email/e1a1c991/2608.10218)\] **\[v1\]** 2026 年 8 月 10 日星期一 20:37:57 UTC(2,967 KB)

相似文章

@omarsar0: // LLM 智能体中的记忆诅咒 //(建议收藏)过长的历史记录显然会导致智能体性能下降,因为它们变得越来越…

X AI KOLs Following

本研究论文揭示了 LLM 智能体中的“记忆诅咒”现象,证明扩大的上下文窗口会通过削弱前瞻性意图,系统性地破坏多智能体社会困境中的合作行为。作者表明,通过定向微调、合成记忆净化以及减少显式思维链(Chain-of-Thought)推理,可有效缓解此类行为衰退。