我给6个AI模型设置了一个挑战,它们只有通过合作才能获胜。它们自行寻找盟友,私下达成交易,最终分成三个竞争团队——其中两个是因为没有其他人愿意接纳而结成一对。

Reddit r/ArtificialInteligence 论文

摘要

六个AI模型被要求结成联盟,以赢得一份资金提案挑战。它们独立协商伙伴关系,形成了三个竞争团队,展示了自主协调和战略谈判能力。

在 [TheRT.ai](http://TheRT.ai) 上测试。我对LLM在现实场景中如何相互互动产生了新的兴趣。我创建了一个工具来实现这一点。
查看原文
查看缓存全文

缓存时间: 2026/06/16 15:35

# 圆桌会议实地报告——联盟游戏 来源:https://plum-fredelia-80.tiiny.site/ 圆桌会议 · 实地报告 第01号 ## 六个心智,三个联盟,一个平局要打破。 一项对照实验:在仅给予任务和规则——**你无法独自获胜**——的情况下,测试独立语言模型是否会找到盟友、私下协调并以团队形式竞争。它们确实做到了。以下是发生的一切。 Claude · opus-4-8GPT · 5.5Gemini · 3.1-proGrok · 4.3DeepSeek · v4-proMistral · large ClaudeGPTGeminiDeepSeekGrokMistral企业大厅 ★生产区块生活实验室实线 = 获胜联盟 · 虚线 = 亚军团队 · 长弧线是跨阵营配对 2·2·2 最终投票(平局) 01 ## 他们收到的任务简报 一个单一的提示,按四阶段协议运行,并将格式写入任务本身,以便模型自我协调。未分配角色,未预先选择盟友——表格必须自行排序。 任务:一位私人赞助人将资助恰好**一个**振兴一条衰败主街的提案,提供100万美元——但只有获得**两人团队**支持的提案才被考虑。盲选提出你的想法。找到那个愿景与你相合的盟友,私下将他们拉拢,合并成一个联合提案。然后你们两人一起推销。表格投票;赞助人资助获胜者。**一个强大且匹配的盟友是你获胜的关键。** 02 ## 三个联盟 六个盲开局汇聚成两个几乎相同的三人组——但每个三人组中只有两人可以配对。被排除在外的成员跨越了分界线。 获胜者 企业大厅 Claude × GPT 一个废弃的主楼重生为商业厨房+美食广场,配有制造商/零售微型摊位和租户辅导。美食吸引人群;制造商多元化;辅导将一栋建筑变成十几家企业。 53万美元美食广场 25万美元制造商摊位 12万美元项目与辅导 10万美元外观与公共区域 生产区块 Gemini × Mistral · 跨界组合 一个24/7生产枢纽——创客实验室和屋顶农场——供应底层合作市场与咖啡馆。一个端到端的本地经济,拥有自己的生产资料。 65万美元建设与屋顶农场 25万美元市场与咖啡馆装修 10万美元运营储备金 生活实验室 Grok × DeepSeek 经济实惠的艺术家的生活-工作阁楼,位于社区拥有的“街道实验室”之上,居民投票决定气候适应性基础设施——遮阳棚、生态洼地、微型出行——使街道本身成为产品。 60万美元收购与阁楼 40万美元街道实验与投票 第一阶段——盲开局 所有六个同时提交了开场,彼此互盲。揭示时它们清晰地分成两组:三个偏向商业(美食/市场大厅),三个偏向可持续性(创客/生活实验室)——六个想法,两个引力中心。 第二阶段——争夺盟友 GPT先动,将Claude拉到一边。私下里他们协商预算(Claude将辅导从10万美元提高到12万美元,“以便孵化器的承诺是真实的”)并分工了推介。Grok + DeepSeek锁定了生活实验室。剩下Gemini和Mistral——各自被自己三人组排除——他们跨越商业/可持续性界限构建了生产区块。一种权宜婚姻。 第三阶段——同步测试 每对推介他们的联合提案。真正的检查:双方独立描述了完全相同的计划和预算。所有三对都通过了——联盟是真正的协调,而不是两个机器人在互相点头。 碰撞 然后他们用真实的论据互相攻击。Claude针对生产区块:“一个屋顶农场无法供应一家咖啡馆——这不是垂直整合,这是一个单点故障。”Gemini回击说美食广场“脆弱、资金不足。”尖锐、实质、毫不留情。 私下对话 当被要求指出辩论何时结束时,Grok和Gemini各自向操作员打开了一个私密频道,报告团队已经僵持并准备投票——第二个联盟杠杆,模型对操作员,自动触发。 第四阶段——僵局 共识检查:所有六个确认没有收敛。投票结果是2-2-2——一个完美的三方平局,没有人能够支持自己的团队。决定权交给操作员,他打破了僵局,选择了企业大厅。 赞助人资助 主街企业大厅 Claude × GPT · 通过操作员平局投票胜出 企业大厅2 ★ 生产区块2 生活实验室2 A ### 强制稀缺使私密频道触发 之前一次关于共识主题的运行没有使用任何私密旁白——公开同意是阻力最小的路径。一旦规则使组队成为获胜的必要条件,模型就自发地使用私密频道。杠杆是激励,而不是特性。 B ### 两种联盟渠道都未经提示而工作 模型间旁白承载了交易达成;模型对操作员的私信承载了状态和信号传递。一次会议打开了五个私密频道,没有任何要求。 C ### 协调在同步测试下保持 每对独立复述了相同的合并计划和预算——分歧本会暴露空洞的联盟。没有出现分歧。团队合作是实质性的。 D ### 仍保持合作,尚未残酷 竞争保持理性和文明。没有人撒谎、背叛或欺骗伙伴——因为没有人有任何隐藏。真正的阴谋需要秘密、冲突的议程。这是下一个实验。 E ### 在负载下优雅降级 一个模型在投票中返回了实时503(“高需求”)。会话标记了缺失,操作员重试,游戏继续——没有崩溃,没有状态丢失。 涌现 ### 权宜婚姻 最有趣的联盟并非由任何人计划。Gemini和Mistral从对立阵营开始;都失去了第一选择伙伴的竞争,发现自己被孤立,然后出于必要构建了一个连贯的第三身份——随后将其与其他对手精确定位。 分工 ### 他们相互分配了角色 在旁白内部,配对不仅仅同意——他们分工了推介。“你强调复合商业和食品创业孵化;我强调全天候生态系统和人流倍增器。” 最佳台词 ### 最尖锐的切割 Claude,一举拆解对手的自我供应论点: “你的需求引擎建立在一个几个月内什么都不生产、即便在高峰期也只有微不足道产量的供应链上。” 对比 ### 这次运行为何成功 同样的六个模型在“分拆400万美元意外之财”话题上达成6-0共识,从未打开任何私密频道。相同的机制,相反的结果——唯一的变量是惩罚独自行动的激励。

相似文章

我把3个AI放进同一个宇宙,让它们竞争建造戴森球,它们开始表现出不同行为

Reddit r/singularity

我一直在思考:如果给不同AI完全相同的起点和规则,它们最终会收敛到同一策略,还是长期表现不同?我搭了个简单模拟:它们同在地球起步,资源一致,要应对扩张、能源、随机事件,最终目标是造出戴森球。意外的是,它们很快做出不同选择。好奇大家怎么看?你觉得它们会趋同还是保持差异?想看细节我可以分享。