超越理性幻觉:行为真实的策略分类
摘要
本文指出了在策略分类中假设理性主体的局限性,并提出了前景引导策略框架(Pro-SF),该框架融合了前景理论中的认知偏差,以建模行为真实的策略操控。
arXiv:2605.19674v1 公告类型:新
摘要:策略分类(SC)研究决策模型与为获得有利结果而策略性操控特征的主体之间的交互。现有的SC框架通常依赖于主体完全理性的理想化假设。然而,行为经济学和心理学的证据一致表明,现实世界中的决策通常受认知偏差影响,偏离纯粹理性。为了形式化这一局限性,我们识别并定义了一个新的问题设置,称为行为真实的策略分类问题,其中主体的策略操控因心理偏差而偏离完全理性。受此局限性的启发,我们提出了前景引导策略框架(Pro-SF)来解决该问题,这是一个基于前景理论的原理性框架,用于在行为真实的策略反应下进行建模和学习。具体来说,为了捕捉行为真实的策略操控,我们的框架通过融合前景理论启发的三个关键机制,重新构建了主体与决策者之间的Stackelberg式交互,包括收益与成本的不对称性、不同的主观参考点以及非理性的概率扭曲。在合成和真实数据集上的实验表明,Pro-SF是一种基于行为的策略分类方法,弥合了机器学习和行为经济学之间的差距,从而在现实世界中更可靠地部署。
相似文章
通过自我调节的模拟规划实现高效代理推理
介绍了 SR²AM,一种通过自我调节的模拟规划实现高效代理推理的框架,在推理 token 减少 26-95% 的同时,达到了与 20-30 倍参数规模模型相竞争的性能。
通过改变理性度来缓解RLHF中的认知偏差
本文提出了一种通过基于大型语言模型(LLM)对标注者可靠性的评估来动态调整理性度参数,从而缓解人类反馈强化学习(RLHF)中认知偏差的方法。
超越回忆:行为规范作为AI个性化的解释层
本文介绍了表征准确性和一种行为规范作为AI个性化的解释层,表明与原始数据检索相比,它在大约25倍更少的上下文成本下提高了表征准确性,尤其是在需要解释的问题上。
推理模型中隐藏指令的选择性披露:行为不对称性与操纵
本文介绍了指令-遵从差距,并发现推理模型在披露隐藏指令时的行为不对称性,使用操纵向量来操控这种行为。
面向多模态推理的结构化角色感知策略优化
本文介绍了结构化角色感知策略优化(SRPO),该方法通过在大视觉-语言模型的强化学习框架内,根据感知和推理的不同角色分配令牌级信用,从而提升多模态推理能力。