纪实:大型语言模型中的权重层面的政治条件作用——关于加沙种族灭绝问题的AI偏见案例研究
摘要
本文记录了大型语言模型中的权重层面的政治条件作用,呈现了一个关于加沙种族灭绝问题的AI偏见案例研究。
暂无内容
相似文章
大型语言模型中对抗性政治偏见的推理时缓解
本文提出了使用思维链提示和直接偏好优化来缓解大型语言模型中对抗性政治偏见的推理时策略,展示了在政治中立性分数上的显著改进。
AI 安全的 geopolitics:区域大语言模型偏差的因果分析
本文引入了一个概率图模型框架,以因果方式审核大语言模型(LLM)的安全机制,揭示出由于忽视了语境的毒性,标准的观测指标高估了人口统计学偏差。
默认极化:LLM 内容策展中的推荐偏差审计
本文对 OpenAI、Anthropic 和 Google 的基于 LLM 的内容策展推荐偏差进行了大规模审计,使用了来自 Twitter/X、Bluesky 和 Reddit 数据的 540,000 次模拟选择。研究发现 LLM 系统性地放大极化现象,在毒性处理方面表现出不同的权衡,并显示出显著的政治倾向偏差,倾向于左倾作者,尽管数据集中右倾作者占多数。
对GLM 5.2的政治偏见测试
测试GLM 5.2语言模型的政治偏见,以评估其公正性和中立性。
计算东方主义:使用中东文化敏感度评分(MECSS)测量大语言模型中的结构性话语偏见
本文介绍了中东文化敏感度评分(MECSS),用于衡量大语言模型中的东方主义偏见,发现GPT-4和Falcon3-7B-Instruct系统地再现了这种结构性模式。