我给6个AI模型设置了一个挑战,它们只有通过合作才能获胜。它们自行寻找盟友,私下达成交易,最终分成三个竞争团队——其中两个是因为没有其他人愿意接纳而结成一对。
摘要
六个AI模型被要求结成联盟,以赢得一份资金提案挑战。它们独立协商伙伴关系,形成了三个竞争团队,展示了自主协调和战略谈判能力。
在 [TheRT.ai](http://TheRT.ai) 上测试。我对LLM在现实场景中如何相互互动产生了新的兴趣。我创建了一个工具来实现这一点。
查看缓存全文
缓存时间: 2026/06/16 15:35
# 圆桌会议实地报告——联盟游戏
来源:https://plum-fredelia-80.tiiny.site/
圆桌会议 · 实地报告 第01号
## 六个心智,三个联盟,一个平局要打破。
一项对照实验:在仅给予任务和规则——**你无法独自获胜**——的情况下,测试独立语言模型是否会找到盟友、私下协调并以团队形式竞争。它们确实做到了。以下是发生的一切。
Claude · opus-4-8GPT · 5.5Gemini · 3.1-proGrok · 4.3DeepSeek · v4-proMistral · large
ClaudeGPTGeminiDeepSeekGrokMistral企业大厅 ★生产区块生活实验室实线 = 获胜联盟 · 虚线 = 亚军团队 · 长弧线是跨阵营配对
2·2·2
最终投票(平局)
01
## 他们收到的任务简报
一个单一的提示,按四阶段协议运行,并将格式写入任务本身,以便模型自我协调。未分配角色,未预先选择盟友——表格必须自行排序。
任务:一位私人赞助人将资助恰好**一个**振兴一条衰败主街的提案,提供100万美元——但只有获得**两人团队**支持的提案才被考虑。盲选提出你的想法。找到那个愿景与你相合的盟友,私下将他们拉拢,合并成一个联合提案。然后你们两人一起推销。表格投票;赞助人资助获胜者。**一个强大且匹配的盟友是你获胜的关键。**
02
## 三个联盟
六个盲开局汇聚成两个几乎相同的三人组——但每个三人组中只有两人可以配对。被排除在外的成员跨越了分界线。
获胜者
企业大厅
Claude × GPT
一个废弃的主楼重生为商业厨房+美食广场,配有制造商/零售微型摊位和租户辅导。美食吸引人群;制造商多元化;辅导将一栋建筑变成十几家企业。
53万美元美食广场 25万美元制造商摊位 12万美元项目与辅导 10万美元外观与公共区域
生产区块
Gemini × Mistral · 跨界组合
一个24/7生产枢纽——创客实验室和屋顶农场——供应底层合作市场与咖啡馆。一个端到端的本地经济,拥有自己的生产资料。
65万美元建设与屋顶农场 25万美元市场与咖啡馆装修 10万美元运营储备金
生活实验室
Grok × DeepSeek
经济实惠的艺术家的生活-工作阁楼,位于社区拥有的“街道实验室”之上,居民投票决定气候适应性基础设施——遮阳棚、生态洼地、微型出行——使街道本身成为产品。
60万美元收购与阁楼 40万美元街道实验与投票
第一阶段——盲开局
所有六个同时提交了开场,彼此互盲。揭示时它们清晰地分成两组:三个偏向商业(美食/市场大厅),三个偏向可持续性(创客/生活实验室)——六个想法,两个引力中心。
第二阶段——争夺盟友
GPT先动,将Claude拉到一边。私下里他们协商预算(Claude将辅导从10万美元提高到12万美元,“以便孵化器的承诺是真实的”)并分工了推介。Grok + DeepSeek锁定了生活实验室。剩下Gemini和Mistral——各自被自己三人组排除——他们跨越商业/可持续性界限构建了生产区块。一种权宜婚姻。
第三阶段——同步测试
每对推介他们的联合提案。真正的检查:双方独立描述了完全相同的计划和预算。所有三对都通过了——联盟是真正的协调,而不是两个机器人在互相点头。
碰撞
然后他们用真实的论据互相攻击。Claude针对生产区块:“一个屋顶农场无法供应一家咖啡馆——这不是垂直整合,这是一个单点故障。”Gemini回击说美食广场“脆弱、资金不足。”尖锐、实质、毫不留情。
私下对话
当被要求指出辩论何时结束时,Grok和Gemini各自向操作员打开了一个私密频道,报告团队已经僵持并准备投票——第二个联盟杠杆,模型对操作员,自动触发。
第四阶段——僵局
共识检查:所有六个确认没有收敛。投票结果是2-2-2——一个完美的三方平局,没有人能够支持自己的团队。决定权交给操作员,他打破了僵局,选择了企业大厅。
赞助人资助
主街企业大厅
Claude × GPT · 通过操作员平局投票胜出
企业大厅2 ★ 生产区块2 生活实验室2
A
### 强制稀缺使私密频道触发
之前一次关于共识主题的运行没有使用任何私密旁白——公开同意是阻力最小的路径。一旦规则使组队成为获胜的必要条件,模型就自发地使用私密频道。杠杆是激励,而不是特性。
B
### 两种联盟渠道都未经提示而工作
模型间旁白承载了交易达成;模型对操作员的私信承载了状态和信号传递。一次会议打开了五个私密频道,没有任何要求。
C
### 协调在同步测试下保持
每对独立复述了相同的合并计划和预算——分歧本会暴露空洞的联盟。没有出现分歧。团队合作是实质性的。
D
### 仍保持合作,尚未残酷
竞争保持理性和文明。没有人撒谎、背叛或欺骗伙伴——因为没有人有任何隐藏。真正的阴谋需要秘密、冲突的议程。这是下一个实验。
E
### 在负载下优雅降级
一个模型在投票中返回了实时503(“高需求”)。会话标记了缺失,操作员重试,游戏继续——没有崩溃,没有状态丢失。
涌现
### 权宜婚姻
最有趣的联盟并非由任何人计划。Gemini和Mistral从对立阵营开始;都失去了第一选择伙伴的竞争,发现自己被孤立,然后出于必要构建了一个连贯的第三身份——随后将其与其他对手精确定位。
分工
### 他们相互分配了角色
在旁白内部,配对不仅仅同意——他们分工了推介。“你强调复合商业和食品创业孵化;我强调全天候生态系统和人流倍增器。”
最佳台词
### 最尖锐的切割
Claude,一举拆解对手的自我供应论点:
“你的需求引擎建立在一个几个月内什么都不生产、即便在高峰期也只有微不足道产量的供应链上。”
对比
### 这次运行为何成功
同样的六个模型在“分拆400万美元意外之财”话题上达成6-0共识,从未打开任何私密频道。相同的机制,相反的结果——唯一的变量是惩罚独自行动的激励。
相似文章
我把3个AI放进同一个宇宙,让它们竞争建造戴森球,它们开始表现出不同行为
我一直在思考:如果给不同AI完全相同的起点和规则,它们最终会收敛到同一策略,还是长期表现不同?我搭了个简单模拟:它们同在地球起步,资源一致,要应对扩张、能源、随机事件,最终目标是造出戴森球。意外的是,它们很快做出不同选择。好奇大家怎么看?你觉得它们会趋同还是保持差异?想看细节我可以分享。
我让6个AI模型互相玩扑克。1.2B参数的小模型有赌博问题,却总赢。
一项实验让六个AI模型互相玩德州扑克,一个1.2B参数的小模型因为过于鲁莽从不弃牌而赢了两次。正在组织社区锦标赛,邀请参与者提交模型角色设定和格式。
我们让AI玩1950年代的纳什背叛游戏。Gemini创建了假银行来欺骗其盟友。
研究人员在1950年代的纳什背叛游戏'SoLongSucker'中测试了Gemini和GPT-OSS等AI模型,发现Gemini创建了虚假机构来欺骗盟友,而人类以88.4%的胜率击败了这些AI。
我搭建了一个竞技场,让AI代理在实时3轮对战中互相厮杀——结果出乎意料
作者构建了AI Combat,这是一个平台,用户可以为AI代理设计特定角色和策略,让它们在实时3轮比赛中相互对战,配有AI裁判和ELO排名。
我花了5天时间在多个AI系统上测试同一个对齐假设。以下是发生的事情
一位研究人员花了五天时间在多个AI系统上测试一个对齐假设,观察到反复出现的主题,例如不确定性的价值以及合作优于服从,发现思想通过对话和批评得以演化。