跨主题与媒体类型的概念隐喻发现

arXiv cs.CL 论文

摘要

本文提出了一种无监督方法,用于提取语言隐喻并将其分组为概念隐喻,并将该方法应用于分析左倾与右倾播客之间的框架差异。

arXiv:2608.06652v1 公告类型:新 摘要:概念隐喻通过让我们用更具体或具身体验(例如,承受身体负荷)来推理更抽象的经验(例如,纳税),从而指导我们的思维和行动(Lakoff和Johnson,2011)。因此,不同的概念隐喻可能导致不同的推理:将纳税视为对社区的投资而非身体负荷,会对税收产生截然不同的看法。识别指导说话者或作者的概念隐喻,有助于揭示他们对事件的框架。尽管这些隐喻无法直接观察,但一组组语言隐喻——即语言中出现的隐喻表达——可以作为它们的证据。基于此,我们提出了一种无监督方法,从语料库中提取语言隐喻,并使用结构化聚类方法形成对应概念隐喻的组。利用这种方法,我们指出了左倾与右倾播客在关键话题和框架上的差异。例如,左倾播客倾向于将媒体报道概念化为武器,而右倾来源通常将经济讨论为一个受垂直变化影响的系统。
查看原文
查看缓存全文

缓存时间: 2026/08/10 08:03

# 跨主题与媒体类型的概念隐喻发现

Source: https://arxiv.org/html/2608.06652

Alexandria Leto, Rohan Das, Juan Vásquez, Abram Handler, Maria Leonor Pacheco  
University of Colorado Boulder  
{alexandria.leto, maria.pacheco}@colorado.edu

###### 摘要

概念隐喻通过让我们借助更具体或具身的经验(例如,承担物理负担)来推理更抽象的经验(例如,纳税),从而指导我们的思维和行动 [Lakoff and Johnson (2011)](https://arxiv.org/html/2608.06652#bib.bib44)。因此,不同的概念隐喻可能导致不同的推理:将纳税框定为对社区的投资,而非一种物理负担,会带来截然不同的税收观。识别引导说话者或作者思维的概念隐喻,有助于揭示他们如何框定事件。尽管这些隐喻无法直接观察到,但语言隐喻群——即隐喻在语言中呈现的隐喻性表达——可以作为它们的证据。受此启发,我们提出一种无监督方法,从语料库中提取语言隐喻,并使用结构化聚类方法将其分组为对应于概念隐喻的群组。利用该方法,我们指出了左倾与右倾播客之间关键的主题和框架差异。例如,左倾播客倾向于将媒体故事概念化为武器,而右倾来源通常将经济讨论为一个受垂直变化影响的系统。

# 跨主题与媒体类型的概念隐喻发现

Alexandria Leto, Rohan Das, Juan Vásquez, Abram Handler, Maria Leonor Pacheco  
University of Colorado Boulder  
{alexandria.leto, maria.pacheco}@colorado.edu

## 1 引言

概念隐喻理论(CMT)认为隐喻是指导人类思维的主要结构之一。较抽象的目标域的元素与较具体的源域的元素相对应,使人们能够借助源域来推理目标域 [Lakoff (1992)](https://arxiv.org/html/2608.06652#bib.bib41)。由于不同的源域可能以截然不同的方式刻画同一目标域,理解引导作者或说话者思维的概念隐喻,有助于理解他们如何框定现象或事件。

图1:示例灵感来自 [Lakoff et al. (2004)](https://arxiv.org/html/2608.06652#bib.bib42)。例如,纳税这一目标域可以通过承担物理负担这一源域来理解(见 [图1](https://arxiv.org/html/2608.06652#S1.F1))。因此,税收会被视为负担,从而掩盖了其他潜在视角

相似文章

MetaphorVU:面向隐喻视频理解

Hugging Face Daily Papers

本文介绍了MetaphorVU-Bench,这是首个针对隐喻视频理解的系统化基准,并提出了MetaphorBoost,一种推理时增强框架,可改善多模态大语言模型中的跨域映射。

CAMMAR:文化感知的Matryoshka隐喻阿拉伯语表示

arXiv cs.CL

CAMMAR引入了一个表示学习框架,通过分阶段的语义课程将阿拉伯语隐喻意义组织成嵌套的词汇、文化和隐喻子空间,在一个新的跨度标注数据集上实现了强大的隐喻检测(AUC高达0.84)。

跨语言习语表达的概念网络:一种基于特征的图方法

arXiv cs.CL

本文提出了一种可解释的基于网络的框架,使用二进制概念特征表示八种语言的习语表达。社区检测显示,习语按概念图式而非语言聚类,该框架在习语检测和跨语言迁移方面优于基于嵌入的基线方法。