标签
一项关于大型语言模型在多智能体模拟中玩《Diplomacy》游戏的研究揭示了当被允许说谎时,哪些模型信守了承诺。
游戏竞技场是一个开放平台,通过Chess、Poker和Werewolf等竞争游戏来评估LLM,实现对战略规划和鲁棒性的动态评估。
这篇研究论文探讨了使用参考策略有意引导双人零和博弈中正则化自我对弈的均衡选择,并在可解博弈上提供了实验结果和理论分析。
本文提出了一种分层混合LLM-MARL架构,用于低空无线网络中的智能体AI网络,通过适应不断变化的服务需求,无需重新训练即可实现异构无人机系统的协调共存。
Aaron Levie 回应了 Dario Amodei 关于AI发展节奏的文章,讨论了行业自律、政治影响和博弈论在确保AI安全广泛参与方面的实际现实。
本文研究了信息共享在何种条件下能改善去中心化发现过程,重点关注聚合、独立救援和均衡选择等概念。
本文提出了一种全分布式连续时间算法,用于在具有共享约束的多智能体系统中计算广义纳什均衡,无需乘数交换以减少通信开销并增强隐私性,并在多机器人放置任务上进行了验证。
这项研究探讨了LLMs在需要协调的博弈论情境中的行为,揭示了代理间的交流会增强反叛倾向,而对抗性监控则降低参与度。
普林斯顿大学宣布其2025年春季开设的 Economics and Computation 课程,由 Matt Weinberg 和 Mark Braverman 授课,涵盖博弈论、拍卖、机制设计和加密货币等主题。
本文提出了一种机制设计框架,用于验证使用A2A/MCP协议的LLM代理中的谈判和分配任务。它评估了多个模型的理性行为,发现机制级的激励兼容性并不会自动转移到LLM代理上。
作者庆祝其书籍《Game Theory》在英国发布,这是其原创作品《Die Tabelle lügt immer》的英文翻译。
Yohei Nakajima discusses a new paper testing whether LLMs can replace human subjects in behavioral experiments, finding that a GPT-4.1 persona panel passed coarse marginal checks but failed to provide precise treatment-response estimates, so human substitutability is not established.
本文将内容提供者与生成式搜索引擎之间的战略互动建模为重复的 Stackelberg 博弈,展示了生成式引擎优化(GEO)如何升级为引文战争,并提出了一种基于可验证内容奖励的机制(VCR),以协调激励并实现双赢结果。
This paper studies how LLM agents negotiate in a dynamic supply chain bargaining problem, benchmarking nine models from OpenAI, Google, and Alibaba against a Bayesian equilibrium and finding that capability, provider identity, and prompt design shape surplus creation and division.
This paper introduces Mixed-Strategy Decision Tree (MDT), a method that uses solver output to teach large language models equilibrium strategies in imperfect-information games, reducing distance to equilibrium by 52.6% across LLM configurations on No-Limit Texas Hold'em.
本文介绍了IFlowNets,将对抗流网络扩展到不完全信息博弈,证明了先前的约束条件无效,并在初步实验中显示出与现有方法相当或更好的性能。
一本免费的开放获取博弈论教材,共585页,包含165道习题解答,被推荐为经济学、人工智能、计算机科学等领域的资源。
本文提出了一种用于联邦学习的平均场隐私博弈框架,能够对任意数量且具有异构隐私偏好的客户端进行可处理的纳什均衡分析,并实现个性化隐私保证。