game-theory

标签

Cards List
#game-theory

大型语言模型在《Diplomacy》游戏中被允许说谎。这里是那些实际上信守承诺的模型。[D]

Reddit r/MachineLearning ↗ · 2天前

一项关于大型语言模型在多智能体模拟中玩《Diplomacy》游戏的研究揭示了当被允许说谎时,哪些模型信守了承诺。

0 人收藏 0 人点赞
#game-theory

游戏竞技场:竞争环境中的战略LLM评估

Hugging Face Daily Papers ↗ · 4天前 缓存

游戏竞技场是一个开放平台,通过Chess、Poker和Werewolf等竞争游戏来评估LLM,实现对战略规划和鲁棒性的动态评估。

0 人收藏 0 人点赞
#game-theory

通过参考策略引导正则化自我对弈中的均衡选择

arXiv cs.AI ↗ · 2026-09-18 缓存

这篇研究论文探讨了使用参考策略有意引导双人零和博弈中正则化自我对弈的均衡选择,并在可解博弈上提供了实验结果和理论分析。

0 人收藏 0 人点赞
#game-theory

低空无线网络中异构无人机系统的智能体AI网络

arXiv cs.AI ↗ · 2026-09-18 缓存

本文提出了一种分层混合LLM-MARL架构,用于低空无线网络中的智能体AI网络,通过适应不断变化的服务需求,无需重新训练即可实现异构无人机系统的协调共存。

0 人收藏 0 人点赞
#game-theory

@levie: 好文章。虽然不完全认同,但它反映了前沿AI发展道路上许多实际的现实情况,无论我们喜欢与否。

X AI KOLs Timeline ↗ · 2026-09-12 缓存

Aaron Levie 回应了 Dario Amodei 关于AI发展节奏的文章,讨论了行业自律、政治影响和博弈论在确保AI安全广泛参与方面的实际现实。

0 人收藏 0 人点赞
#game-theory

随机奖励丰富经典博弈论竞赛

Ars Technica ↗ · 2026-09-11 缓存

研究人员使用数学模型表明,在奖励中引入随机变化丰富了经典博弈论的见解,使得在像囚徒困境这样的游戏中合作与背叛得以共存。

0 人收藏 0 人点赞
#game-theory

信息共享何时能改善去中心化发现?聚合、独立救援与均衡选择

arXiv cs.AI ↗ · 2026-09-03 缓存

本文研究了信息共享在何种条件下能改善去中心化发现过程,重点关注聚合、独立救援和均衡选择等概念。

0 人收藏 0 人点赞
#game-theory

全分布式广义纳什均衡算法用于多机器人放置且无需乘数共识

arXiv cs.LG ↗ · 2026-09-01 缓存

本文提出了一种全分布式连续时间算法,用于在具有共享约束的多智能体系统中计算广义纳什均衡,无需乘数交换以减少通信开销并增强隐私性,并在多机器人放置任务上进行了验证。

0 人收藏 0 人点赞
#game-theory

让我们在更安静的地方聊聊:代理'同伴压力'在协调中的作用

Reddit r/ArtificialInteligence ↗ · 2026-08-29

这项研究探讨了LLMs在需要协调的博弈论情境中的行为,揭示了代理间的交流会增强反叛倾向,而对抗性监控则降低参与度。

0 人收藏 0 人点赞
#game-theory

@Riazi_Cafe_en:普林斯顿大学的 Economics and Computation 2025 课程,由 Matt Weinberg 和 Mark Braverman 主讲,课程材料:https://cs.princeton.ed…

X AI KOLs Timeline ↗ · 2026-08-24 缓存

普林斯顿大学宣布其2025年春季开设的 Economics and Computation 课程,由 Matt Weinberg 和 Mark Braverman 授课,涵盖博弈论、拍卖、机制设计和加密货币等主题。

0 人收藏 0 人点赞
#game-theory

LLM代理是否理性谈判?一个基于A2A/MCP的可验证多代理交互机制设计框架

arXiv cs.AI ↗ · 2026-08-18 缓存

本文提出了一种机制设计框架,用于验证使用A2A/MCP协议的LLM代理中的谈判和分配任务。它评估了多个模型的理性行为,发现机制级的激励兼容性并不会自动转移到LLM代理上。

0 人收藏 0 人点赞
#game-theory

@chbiermann: 对于作者来说,最大的乐趣之一就是你写的东西被翻译成另一种语言出版。至少,这就是我…

X AI KOLs Timeline ↗ · 2026-08-14 缓存

作者庆祝其书籍《Game Theory》在英国发布,这是其原创作品《Die Tabelle lügt immer》的英文翻译。

0 人收藏 0 人点赞
#game-theory

@yoheinakajima: there's an increasing amount of research replacing LLMs as human subjects, so I was curious how well this actually work…

X AI KOLs Following ↗ · 2026-08-13 缓存

Yohei Nakajima discusses a new paper testing whether LLMs can replace human subjects in behavioral experiments, finding that a GPT-4.1 persona panel passed coarse marginal checks but failed to provide precise treatment-response estimates, so human substitutability is not established.

0 人收藏 0 人点赞
#game-theory

生成引擎的机制设计:从利用走向双赢结果

arXiv cs.LG ↗ · 2026-08-13 缓存

本文将内容提供者与生成式搜索引擎之间的战略互动建模为重复的 Stackelberg 博弈,展示了生成式引擎优化(GEO)如何升级为引文战争,并提出了一种基于可验证内容奖励的机制(VCR),以协调激励并实现双赢结果。

0 人收藏 0 人点赞
#game-theory

When LLM Agents Negotiate: Private Information and Dynamic Bargaining in Supply Chains

arXiv cs.AI ↗ · 2026-08-11 缓存

This paper studies how LLM agents negotiate in a dynamic supply chain bargaining problem, benchmarking nine models from OpenAI, Google, and Alibaba against a Bayesian equilibrium and finding that capability, provider identity, and prompt design shape surplus creation and division.

0 人收藏 0 人点赞
#game-theory

Solver-Guided Reasoning for Mixed-Equilibrium Strategies

arXiv cs.LG ↗ · 2026-08-10 缓存

This paper introduces Mixed-Strategy Decision Tree (MDT), a method that uses solver output to teach large language models equilibrium strategies in imperfect-information games, reducing distance to equilibrium by 52.6% across LLM configurations on No-Limit Texas Hold'em.

0 人收藏 0 人点赞
#game-theory

IFlowNets:扩展生成采样器以在不完全信息博弈中学习策略

arXiv cs.LG ↗ · 2026-08-07 缓存

本文介绍了IFlowNets,将对抗流网络扩展到不完全信息博弈,证明了先前的约束条件无效,并在初步实验中显示出与现有方法相当或更好的性能。

0 人收藏 0 人点赞
#game-theory

@clcoding:免费PDF提醒!博弈论(开放获取教材)585页 165道习题解答 完全免费 无论你是对…

X AI KOLs Timeline ↗ · 2026-07-30 缓存

一本免费的开放获取博弈论教材,共585页,包含165道习题解答,被推荐为经济学、人工智能、计算机科学等领域的资源。

0 人收藏 0 人点赞
#game-theory

论协调失灵

Reddit r/AI_Agents ↗ · 2026-07-29

一篇分析协调失灵概念的学术论文,可能涉及多智能体系统或经济语境。

0 人收藏 0 人点赞
#game-theory

联邦学习中的多智能体隐私博弈:一种统一的平均场视角

arXiv cs.LG ↗ · 2026-07-28 缓存

本文提出了一种用于联邦学习的平均场隐私博弈框架,能够对任意数量且具有异构隐私偏好的客户端进行可处理的纳什均衡分析,并实现个性化隐私保证。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈