数十亿张涂鸦揭示人类概念中隐藏的文化差异
摘要
对来自236个国家的26亿张涂鸦的分析揭示了常见概念视觉呈现中隐藏的文化差异,表明视觉意象保留了语言模型所压缩的丰富语义和文化结构。
arXiv:2607.07267v1 Announce Type: cross
摘要:关于人类概念普遍性的主张主要通过跨语言和文化的语言相似性来评估。然而,词语作为交流工具之所以有效,是因为它们将丰富的经验变异压缩为共享的惯例,可能掩盖了概念在心理表征方式上的隐藏个体和文化差异。在这里,我们分析了来自236个国家和地区的26亿张人类绘制的常见概念涂鸦,通过人们的视觉想象来考察概念结构。与近期关于基于图像认知的研究一致,我们发现单个概念会展开为多个不同的视觉实例,揭示了跨文化概念结构相似性和差异性的潜在信息。这种差异在涉及触觉交互的概念中最为显著,表明视觉意象既反映传统定义,也反映具身经验的变异。通过比较涂鸦的嵌入模型和跨语言的词嵌入模型,我们发现它们的几何结构存在差异,视觉表征保留了语言模型所压缩的丰富语义和文化结构。基于涂鸦得出的跨文化相似性与既定的文化距离之间的吻合度比基于文本的测量高出45%。这些结果共同表明,人类概念普遍性的模式可能关键取决于测量概念所使用的模态,大规模涂鸦为探索思维中具身和文化维度的概念多样性提供了直接、高分辨率的探针。
查看缓存全文
缓存时间: 2026/07/09 07:52
# 数十亿幅涂鸦揭示人类概念中隐藏的文化差异 来源:https://arxiv.org/abs/2607.07267 查看 PDF (https://arxiv.org/pdf/2607.07267) > **摘要:** 关于人类概念普遍性的主张,过去主要依据不同语言和文化之间的词汇相似性进行评估。然而,词语之所以能作为有效的交流工具,是因为它们将丰富的经验差异压缩为共享的惯例,这可能会掩盖个体与文化在概念心理表征上的潜在差异。本文分析了来自236个国家和地区、共计26亿幅由人类绘制的常见概念涂鸦,通过人们的视觉想象来研究概念结构。与近期基于图像认知的研究一致,我们发现单一概念会展开为多个不同的视觉样本,揭示出跨文化概念结构中的潜在相似性和差异。这种差异在涉及触觉交互的概念中最为显著,表明视觉意象所反映的经验变异性,其程度不亚于常规定义。通过将涂鸦的嵌入模型与跨语言词嵌入模型进行比较,我们发现两者的几何结构存在分歧——视觉表征保留了语言模型所压缩的丰富语义与文化结构。基于涂鸦所导出的跨文化相似性,与既有文化距离指标的吻合度比基于文本的衡量标准高出45%。综合这些结果,人类概念普遍性的模式可能关键取决于测量概念时所采用的方式——大规模涂鸦作为一种直接、高分辨率的探测手段,能够揭示思想中具身与文化维度的概念多样性。 ## 提交历史 来自:Arianna Pera \[查看邮件 (https://arxiv.org/show-email/bc27ebcf/2607.07267)\] **\[v1\]** 2026年7月8日星期三 10:51:06 UTC (6,990 KB)
相似文章
MemeCULT-1K: 评估多模态模型对南亚文化背景和幽默的理解
本文介绍了MemeCULT-1K,一个包含1000个南亚模因的多语言基准,用于评估视觉语言模型对文化背景和幽默的理解,表明提供文化背景可以提高模型性能。
ArtECulture:多模态大语言模型中文化条件视觉情感理解的基准测试
本文介绍了ArtECulture,这是一个用于多模态大语言模型中文化条件视觉情感理解的基准测试,涵盖英语、中文和阿拉伯文化,并包含均衡的西方和非西方艺术作品。评估表明该任务仍具挑战性,作者提出了一种检索增强框架,将文化知识注入多模态大语言模型(MLLMs)。
@FutureJurvetson: 这在我的J-Space中深入展开。我一直对可解释性研究能否取得成果持怀疑态度,但这次更新确实……
Anthropic的新研究揭示了语言模型中的全局工作空间,展示了人脑中的意识与潜意识划分与Claude的内部推理之间存在惊人的相似性。
换种视角:在计算创造力中用四世界框架建模解释性视角
本文提出了一个四世界框架,用于在计算创造力中对解释性视角进行建模。研究以GPT-4.1作为基于角色的评估器,对SemArt数据集中的1,069件艺术品进行评估。结果显示,形式主义、社会历史与图像志三种视角之间存在系统性分歧;CLIP探针揭示了每种视角对应的不同方向向量。
多模态语言模型中的校准模糊性:人类倾向于文化引用,而模型描述画面
本文探讨校准模糊性作为人类交流与多模态语言模型中的生成资源,通过Dixit游戏展示AI表现出模糊性崩溃且缺乏文化引用,与人类形成对比。