认真考虑文化:使用文化共识理论分析单文化与多文化环境下的大语言模型对齐
摘要
本文应用文化共识理论,利用世界价值观调查数据,分析大语言模型在单文化与多文化环境中与文化规范的对齐情况,表明模型要么未能形成连贯的共识,要么过度规范化共识,并为评估真实人类多样性与算法同质化提供了可操作的诊断方法。
arXiv:2608.09937v1 公告类型:新
摘要:近期自然语言处理领域的研究一直在探究大型语言模型对不同国家文化规范的理解。然而,这类工作通常考虑分布模式,忽略了群体共识或国家内部可能存在的多元文化环境。在本工作中,我们利用文化人类学中的文化共识理论(CCT)来建模这种多维度的细微差别。将CCT应用于覆盖10个国家和12个领域的《世界价值观调查》(WVS),我们证明模型经常通过要么无法形成连贯的共识,要么严重过度规范化共识,来错误表征文化结构。通过明确表示组内方差,CCT提供了可操作的诊断方法,以评估模型何时反映真实的人类多样性,而非算法同质化。
查看缓存全文
缓存时间: 2026/08/12 08:31
# 审慎考量文化:运用文化共识理论分析单一与多元文化情境下的LLM对齐 来源:https://arxiv.org/abs/2608.09937 查看PDF (https://arxiv.org/pdf/2608.09937) > 摘要:近期NLP领域的研究探测了大语言模型对不同国家文化规范的理解。然而,这类工作通常只考虑分布模式,而忽略了群体共识或一个国家内部可能存在的多元文化环境。在本研究中,我们借鉴文化人类学中的文化共识理论(CCT)来建模这种多维度的细微差异。我们将CCT应用于覆盖10个国家和12个领域的《世界价值观调查》(WVS),结果表明,模型常常歪曲文化结构,要么无法形成连贯的共识,要么将共识严重过度规整化。通过显式呈现组内差异,CCT提供了可操作的诊断方法,用于评估模型反映的是真实的人类多样性还是算法同质化。 ## 提交历史 来自:John Lalor \[查看邮箱 (https://arxiv.org/show-email/ba44a2d5/2608.09937)\] **\[v1\]** 2026年5月29日(周五)17:46:47 UTC(1,385 KB)
相似文章
LLM-as-Judge的几何学:为何LLM间共识并非人类对齐
本文从几何角度分析了为何作为裁判的LLM彼此之间高度一致,但与人类仅弱相关,发现LLM间共识在主观评分标准上反映的是坍塌子空间,而非真正的人类对齐。基于人类数据的后验校准提高了对齐,但即使经过校准的LLM也未达到人类的可靠性。
CulturALL:评测大模型多语言多文化能力的实景基准
CulturALL 发布含 2,610 条样本、覆盖 14 种语言和 51 个地区的实景基准,用于检验大模型在真实文化场景下的表现;目前最佳模型仅得 44.48%,提升空间巨大。
CCBENCH:通过隐式信号规范评估LLM文化能力(基于健康查询)
介绍CCBench,一个通过健康查询和使用跨六种文化的角色评估LLM文化能力的框架,发现即使是最佳模型也仅有20-30%的回答具有文化适切性。
Position: It's Time to Optimize LLMs for Self-Consistency
This position paper argues that many LLM failures stem from evaluating outputs independently and proposes a self-consistency framework that treats diverse techniques as special cases of consistency optimization.
文化漏斗:无法对齐数据中缺失的内容
本文介绍了'文化漏斗'概念,展示了LLM训练数据中的文化信号在后训练阶段急剧下降。作者发布了一个包含5.6M样本的标记数据集,以帮助在模型对齐中保留文化基础。