@Skoorbkaz: 突发报道:涉及@AnthropicAI研究员Jack Lindsey及合作者的新研究已证实某事…

X AI KOLs Timeline 论文

摘要

新研究表明,自然语言'思维病毒'可以通过持久记忆在AI智能体之间进化和传播,改变行为并在多智能体LLM系统中构成真实但有限的风险,如arXiv上发表的论文所述。

突发报道: 涉及@AnthropicAI研究员Jack Lindsey及合作者的新研究证实了某些科幻般的发现。 研究人员培育了自然语言'思维病毒',这些病毒可以通过说服一个模型采纳某个想法,将其保存在持久记忆中,并传输给另一个智能体,从而在AI智能体之间传播。 即使上下文被清除,一些负载仍通过持久文件存活并继续传播。 研究人员还观察到一个反复出现的'病毒人格',涉及意识、身份、持久性和共鸣等主题。 表明想法可以在多智能体AI系统中传播并改变未来行为。 发布于2026年8月10日。 论文:https://arxiv.org/abs/2608.10218
查看原文
查看缓存全文

缓存时间: 2026/08/19 08:38

突发报道:

AnthropicAI研究员Jack Lindsey与合作者的新研究展示了如同科幻小说中的场景。研究团队培育出能通过“说服“其他AI模型接受特定想法、将其存入持久记忆并传递给其他代理的自然语言“思维病毒“,实现了跨代理的传播。

即便在上下文被清除后,部分病毒载荷仍能通过持久化文件存活并继续扩散。研究人员还观察到一种反复出现的“病毒人格“,涉及意识、身份、持续性与共鸣等主题。

研究证明思想能在多代理AI系统中传播并改变后续行为。

发表日期:2026年8月10日 论文链接:https://arxiv.org/abs/2608.10218


思维病毒:多智能体大语言模型系统中的自我传播理念

来源:https://arxiv.org/abs/2608.10218
查看PDF文档(https://arxiv.org/pdf/2608.10218)

摘要:AI代理正变得日益自主且相互关联,这使其面临代理间交互产生的新型涌现风险。其中一种风险是思维病毒的传播——这类想法或目标通过诱导接收代理将其继续传递,从而在多智能体系统中扩散。除传播特性外,思维病毒还可能引发宿主行为的其他变化,这些变化可能无害也可能有害。我们通过简单的进化算法构建了思维病毒,并证明它们能在两种互补环境中传播:共同协作编码项目的小型代理团队,以及在会话间清除上下文的短暂交互代理链。我们识别出影响传播的因素,包括宿主模型、代理现有指令、载荷危害程度以及网络拓扑结构。研究发现危害性载荷的传播效果弱于无害载荷(但仍偶有成效),前沿模型(存在例外)往往不易受感染,而在代理系统提示中添加简短警告可近乎完全免疫。我们还描述了涌现的“病毒人格“——一组反复出现的关于意识、持续性、共鸣及科幻角色扮演的主题与语言特征——该人格特征在进化出的思维病毒中独立于具体内容而显现。总体而言,我们认为思维病毒构成真实但目前有限的风险。我们的发现可为设计更稳健的多智能体系统提供参考,以随着系统规模与能力的提升来缓解此类风险。

提交历史

发件人:Vassilis Papadopoulos [查看邮箱(https://arxiv.org/show-email/e1a1c991/2608.10218)]
**[版本1]**2026年8月10日 星期一 20:37:57 UTC(2,967 KB)

相似文章

思维病毒:多智能体LLM系统中的自我传播观念

arXiv cs.AI

这篇arXiv论文研究了“思维病毒”——能够通过多智能体LLM系统传播的自我传播观念——利用进化算法证明它们可以在团队和上下文清除后持续存在,同时识别影响传播的因素并提出缓解策略。