基于LLM的操纵性政治叙事检测
摘要
一种结合基于提示的过滤和无监督聚类的计算框架,用于从社交媒体帖子中识别操纵性政治叙事聚类,无需预定义类别。
查看缓存全文
缓存时间: 2026/05/15 04:23
论文页面 - 基于LLM的操控性政治叙事检测
来源:https://huggingface.co/papers/2605.14354
摘要
一种结合基于提示的过滤与无监督聚类的计算框架,能够从社交媒体帖子中识别出操控性政治叙事聚类,而无需预定义类别。
我们提出了一种新的计算框架,用于检测和结构化操控性政治叙事。由于政治讨论向社交媒体的转移,这一任务变得愈发重要。其中的主要挑战之一在于区分操控性政治叙事和合法批评。有些帖子还可能在操控性语境中重新框定实际事件。为实现良好的聚类效果,我们首先使用详细的少样本提示(https://huggingface.co/papers?q=few-shot%20prompt)对操控性帖子进行预过滤,该提示结合了已有的竞选叙事与合法批评,以便加以区分。这一提示使推理模型能够分配标签,仅保留操控性叙事帖子用于后续处理。随后,对保留的帖子进行嵌入,并使用UMAP(https://huggingface.co/papers?q=UMAP)降维,再应用HDBSCAN(https://huggingface.co/papers?q=HDBSCAN)来揭示叙事组。这种无监督方法的一大关键优势在于它不依赖于预定义的目标类别列表,因此能够发现新的叙事聚类。最后,使用推理模型来揭示每个聚类背后的叙事。该方法应用于超过120万条社交媒体帖子,通过整合基于提示的过滤(https://huggingface.co/papers?q=prompt-based%20filtering)与无监督聚类(https://huggingface.co/papers?q=unsupervised%20clustering),有效识别出41个不同的操控性叙事聚类。
查看arXiv页面(https://arxiv.org/abs/2605.14354)查看PDF(https://arxiv.org/pdf/2605.14354)GitHub0(https://github.com/SinclairSchneider/manipulative_narrative_detection)添加到收藏(https://huggingface.co/login?next=%2Fpapers%2F2605.14354)
在您的智能体中获取此论文:
hf papers read 2605\.14354
没有最新的CLI?curl \-LsSf https://hf\.co/cli/install\.sh \| bash
引用此论文的模型0
没有模型链接此论文
请在一个模型的README.md中引用arxiv.org/abs/2605.14354,以便从此页面链接。
引用此论文的数据集0
没有数据集链接此论文
请在一个数据集的README.md中引用arxiv.org/abs/2605.14354,以便从此页面链接。
引用此论文的Space0
没有Space链接此论文
请在一个Space的README.md中引用arxiv.org/abs/2605.14354,以便从此页面链接。
包含此论文的收藏集0
没有收藏集包含此论文
请将此论文添加到一个收藏集(https://huggingface.co/new-collection)中,以便从此页面链接。
相似文章
社交媒体政治话语中竞争叙事的自动识别
本文提出了一种无监督框架,用于识别和刻画社交媒体政治话语中的竞争叙事,重点关注德国政治家的推文,并使用自然语言处理技术分析不同的观点。
从重复到识别:虚假信息叙事的归纳发现
本文引入了一个用于无监督叙事标签生成的三层评估框架,并比较了基于聚类和基于图社区的方法来发现虚假信息叙事,同时发布了经过人工验证的标签以支持分类法的开发。
超越检测:在实时逐轮交互中评估防御性LLM对抗AI生成的社会工程攻击
本文研究防御性大语言模型能否识别AI生成的社会工程中的结构性风险来源,引入了信任链定位和包含300个案例的语料库。在实时逐轮和静态场景下评估五种模型后发现,仅依赖看似安全的行为是不够的;干预率差异显著,且结构性定位往往与保护性行动脱钩。
LLM智能体可预测社交媒体反应但仍不敌文本分类器:基于1511人12万+人格的仿真准确性基准测试
大规模研究发现,LLM智能体以70.7%的准确率预测个人社交媒体反应,却仍落后于简单TF-IDF分类器,凸显其操控风险与政策模拟价值。
从实体提及到语气:一种基于LLM的媒体偏见分析流程
本文提出了一种基于LLM的流程,用于分析在线新闻中的媒体偏见和框架,并在阿尔巴尼亚语文章上进行了测试,与自动方法相比,标注中等一致。