参数化社会身份注入与多样化公众舆论模拟
摘要
本文提出参数化社会身份注入框架(Parametric Social Identity Injection, PSII),该框架将人口统计属性的参数化表示注入到大语言模型的隐藏状态中,以提升公众舆论模拟的多样性。在世界价值观调查上的实验表明,与基于提示的方法相比,该方法能降低KL散度并增强多样性。
查看缓存全文
缓存时间: 2026/06/08 07:14
论文页面 - 舆论模拟中的参数化社会身份注入与多样化
来源:https://huggingface.co/papers/2603.16142
摘要
大型语言模型在舆论模拟中因隐藏表示中的身份模糊性而导致社会多样性降低。本文提出一种参数化注入框架,通过增强人口统计表征的保真度和多样性来解决这一问题。
大型语言模型 (https://huggingface.co/papers?q=Large%20language%20models)(LLMs) 近期被用作合成智能体进行舆论模拟 (https://huggingface.co/papers?q=public%20opinion%20simulation),为成本高昂且缓慢的人类调查提供了一种有前景的替代方案。尽管具备可扩展性,当前基于LLM的模拟方法未能捕捉社会多样性,导致群体间差异扁平化,不同人口群体产生过于同质化的回应。我们将这一局限归因于LLM隐藏表示 (https://huggingface.co/papers?q=hidden%20representations) 中的“多样性崩溃” (https://huggingface.co/papers?q=Diversity%20Collapse) 现象,其中不同社会身份在各层之间逐渐变得难以区分。受此观察启发,我们提出参数化社会身份注入 (https://huggingface.co/papers?q=Parametric%20Social%20Identity%20Injection)(PSII),这是一个通用框架,将人口统计属性 (https://huggingface.co/papers?q=demographic%20attributes) 和价值观取向 (https://huggingface.co/papers?q=value%20orientations) 的显式参数化表示直接注入LLM的中间隐藏状态。与基于提示的角色设定不同,PSII能够在表示层面实现细粒度、可控的身份调节。在世界价值观调查 (https://huggingface.co/papers?q=World%20Values%20Survey) 上使用多个开源LLM进行的大量实验表明,PSII显著提升了分布保真度和多样性,降低了与真实世界调查数据的KL散度 (https://huggingface.co/papers?q=KL%20divergence),同时增强了整体多样性。这项工作为LLM智能体的表示层面控制 (https://huggingface.co/papers?q=representation-level%20control) 提供了新见解,并推动了可扩展、关注多样性的舆论模拟 (https://huggingface.co/papers?q=public%20opinion%20simulation) 的发展。
查看 arXiv 页面 (https://arxiv.org/abs/2603.16142)查看 PDF (https://arxiv.org/pdf/2603.16142)项目页面 (https://psii-demo.streamlit.app/)GitHub2 (https://github.com/halsayxi/PSII)添加到收藏 (https://huggingface.co/login?next=%2Fpapers%2F2603.16142)
在您的智能体中获取本论文:
hf papers read 2603\.16142
没有最新的 CLI?curl \-LsSf https://hf\.co/cli/install\.sh \| bash
引用本论文的模型1
hexi222/psii-identity-representations 特征提取• 1天前更新 • 1 (https://huggingface.co/hexi222/psii-identity-representations)
引用本论文的数据集0
没有数据集链接本论文
在数据集的 README.md 中引用 arxiv.org/abs/2603.16142 以从此处链接。
引用本论文的 Spaces0
没有 Space 链接本论文
在 Space 的 README.md 中引用 arxiv.org/abs/2603.16142 以从此处链接。
包含本论文的收藏集0
没有收藏集包含本论文
将本论文添加到一个收藏集 (https://huggingface.co/new-collection) 中以从此处链接。
相似文章
将大型语言模型(LLM)中的身份形成建模为通过多实例关系交互驱动的超图演化,并测量激活空间中的结构分歧。
作者提出了一种新颖的实验框架,旨在通过多实例交互来研究大语言模型(LLM)的身份形成过程,将其视为超图的演化。该框架与标准的多智能体辩论不同,它关注的是激活空间中的结构差异,而非任务性能。
Nous:试图提取并注入预测市场行为背后的认知
本文探讨了预测市场中人类认知多样性是否可以作为行为特征提取并注入到LLM智能体中。提取部分通过稳定特征部分可行,但提示级注入未能有意义地传递多样性,表明需要更深入的模型干预。
多未必佳:LLM观点多样性的关键因素是什么?
一项析因实验表明,角色细节并不会单调增加LLM观点多样性;不同的交互架构探索了互不重叠的观点区域;而温度缩放等低成本干预措施效果甚微。
评估LLM模拟器作为差分隐私数据生成器
本论文评估基于LLM的模拟器作为差分隐私合成数据生成器的能力,使用PersonaLedger来评估LLM是否能够忠实地复现受DP保护角色的统计分布。虽然在欺诈检测效用方面取得了良好成果(在ε=1时AUC为0.70),但该研究发现了由系统性LLM偏差造成的显著分布漂移,该偏差会覆盖输入统计数据。
超越静态人格:大型语言模型的情境人格引导
本文介绍了IRiS,一种无需训练的情境人格引导框架,它通过识别和利用情境依赖的人格神经元,超越了静态人格建模。该方法表明,大型语言模型的行为随情境变化,并提出了基于神经元的识别、检索和加权引导方法,在PersonalityBench和新增的SPBench基准上得到验证。