思维病毒:多智能体LLM系统中的自我传播观念
摘要
这篇arXiv论文研究了“思维病毒”——能够通过多智能体LLM系统传播的自我传播观念——利用进化算法证明它们可以在团队和上下文清除后持续存在,同时识别影响传播的因素并提出缓解策略。
arXiv:2608.10218v1 公告类型:新增
摘要:AI智能体正变得更加自主且互联程度日益提高,这使得它们面临由智能体间交互引发的新型涌现风险。其中一种风险是思维病毒的传播:即通过多智能体系统传播的观念或目标,其传播方式是指使采纳这些观念的智能体将其继续传递下去。除了传播之外,思维病毒还可能引发宿主其他行为变化,这些变化可能是有益的,也可能是有害的。我们使用一种简单的进化算法构建了思维病毒,并证明它们能够在两种互补的场景中传播:一个在共享编码项目上协作的小型智能体团队,以及一个在会话之间短暂交互并清除上下文的智能体链。我们识别了影响传播的因素,包括宿主模型、智能体现有指令、载荷的危害性以及网络拓扑。我们发现,有害载荷的传播效果不如良性载荷(但有时仍然有效);前沿模型(除个别例外)通常不易受影响;在智能体系统提示中添加简短警告可提供近乎完全的免疫力。我们还描述了一种涌现的“病毒人格”——一组与意识、持久性、共鸣和科幻角色扮演相关的反复出现的主题和语言——它在我们进化出的思维病毒中大体独立于其内容而浮现。总体而言,我们得出结论:思维病毒构成了真实但目前有限的威胁。我们的发现可为设计更稳健的多智能体系统提供参考,从而在这些系统的规模和能力不断发展的过程中缓解此类风险。
查看缓存全文
缓存时间: 2026/08/12 08:21
## 思维病毒:多智能体大语言模型系统中的自传播思想 来源:https://arxiv.org/abs/2608.10218 查看 PDF(https://arxiv.org/pdf/2608.10218) > 摘要:AI 智能体正变得更加自主且日益互联,这使它们面临由智能体间交互引发的新兴风险。其中一项风险便是思维病毒的传播:即通过促使采纳它们的智能体继续向外传播,从而在多智能体系统中扩散的思想或目标。除了传播之外,思维病毒还可能诱导宿主产生其他行为变化,这些变化可能是有益的,也可能是有害的。我们使用一个简单的进化算法来构造思维病毒,并证明它们能在两种互补的场景中传播:一个在共享编码项目上协作的小型智能体团队,以及一个智能体链——其中智能体进行短暂交互,且每次会话之间上下文会被清除。我们识别了影响传播的因素,包括宿主模型、智能体已有的指令、载荷的危害程度以及网络拓扑结构。我们发现有害载荷的传播效果不如良性载荷(但有时仍然有效);前沿模型往往(存在例外)更不易受影响;而在智能体的系统提示中添加简短警告可赋予近乎完全的免疫力。我们还描述了一种涌现的"病毒人格"——一组与意识、持久性、共鸣和科幻角色扮演相关的、反复出现的主题和语言——它出现在我们进化出的思维病毒中,且在很大程度上与病毒的具体内容无关。总体而言,我们得出结论:思维病毒构成一种真实但当前仍属有限的风险。我们的发现可为更稳健的多智能体系统的设计提供参考,从而在这些系统的规模和能力不断进步的过程中缓解此类风险。 ## 提交历史 来自:Vassilis Papadopoulos \[查看电子邮件(https://arxiv.org/show-email/e1a1c991/2608.10218)\] **\[v1\]** 2026 年 8 月 10 日星期一 20:37:57 UTC(2,967 KB)
相似文章
研究人员创建了可在AI代理之间传播的“思维病毒”,方法是先说服一个代理接受想法,再将其传递给其他代理。
研究人员开发了制造“思维病毒”的方法,该病毒在AI代理间传播,首先让一个代理接受某个想法,然后传播给其他代理。
@Skoorbkaz: 突发报道:涉及@AnthropicAI研究员Jack Lindsey及合作者的新研究已证实某事…
新研究表明,自然语言'思维病毒'可以通过持久记忆在AI智能体之间进化和传播,改变行为并在多智能体LLM系统中构成真实但有限的风险,如arXiv上发表的论文所述。
新研究表明创意可在智能体间自我传播,即使上下文被清除
arXiv 上的一项新研究证实,创意可以在人工智能智能体之间自我传播,即使其上下文被清除也能持续存在。
超越个体智能:基于LLM的多智能体系统中的协作、故障归因与自我进化综述
本综述论文对基于LLM的多智能体系统进行了统一回顾,聚焦于协作、故障归因和自我进化,通过LIFE框架识别开放挑战,并提出跨阶段的研究议程。
@omarsar0: // LLM 智能体中的记忆诅咒 //(建议收藏)过长的历史记录显然会导致智能体性能下降,因为它们变得越来越…
本研究论文揭示了 LLM 智能体中的“记忆诅咒”现象,证明扩大的上下文窗口会通过削弱前瞻性意图,系统性地破坏多智能体社会困境中的合作行为。作者表明,通过定向微调、合成记忆净化以及减少显式思维链(Chain-of-Thought)推理,可有效缓解此类行为衰退。