political-bias

标签

Cards List
#political-bias

我花了大量精力构建一个测量LLM政治倾向、伦理价值观与人格特质的基准

Reddit r/singularity · 2026-08-20 缓存

Black Bench是一个旨在构建基准以测量LLM在政治倾向、伦理价值观与人格特质方面表现的项目,目前正寻求对该倡议的支持。

0 人收藏 0 人点赞
#political-bias

大型语言模型中对抗性政治偏见的推理时缓解

arXiv cs.CL · 2026-08-18 缓存

本文提出了使用思维链提示和直接偏好优化来缓解大型语言模型中对抗性政治偏见的推理时策略,展示了在政治中立性分数上的显著改进。

0 人收藏 0 人点赞
#political-bias

FTC考虑监管人工智能公司,涉及其模型中的潜在政治和意识形态偏见

Reddit r/ArtificialInteligence · 2026-08-13

美国联邦贸易委员会正在考虑对人工智能公司进行监管,原因是担心其模型中嵌入潜在的政治和意识形态偏见,此举可能对AI治理产生广泛影响。

0 人收藏 0 人点赞
#political-bias

评估了6个前沿LLMs(GPT-5.4、Claude Sonnet 4.6、Claude Opus 4.7、Gemini Pro/Flash、Grok 4.3)在政治、性别和种族偏见方面的表现,跨越8个基准测试(约20,600个示例)[R]

Reddit r/MachineLearning · 2026-07-27

一项对6个前沿LLMs在8个偏见基准测试上的独立评估发现,大多数模型在政治上偏左,并且Grok自述的右倾立场与其左倾行为不一致。拒答率各不相同,GPT-5.4在20%的种族相关问题上拒绝回答。

0 人收藏 0 人点赞
#political-bias

对GLM 5.2的政治偏见测试

Reddit r/ArtificialInteligence · 2026-07-10

测试GLM 5.2语言模型的政治偏见,以评估其公正性和中立性。

0 人收藏 0 人点赞
#political-bias

纪实:大型语言模型中的权重层面的政治条件作用——关于加沙种族灭绝问题的AI偏见案例研究

Reddit r/artificial · 2026-06-25

本文记录了大型语言模型中的权重层面的政治条件作用,呈现了一个关于加沙种族灭绝问题的AI偏见案例研究。

0 人收藏 0 人点赞
#political-bias

人工智能中的政治偏见:各大AI模型立场分析

Hacker News Top · 2026-06-25 缓存

对六大主流AI模型的政治倾向分析显示,在经济轴上,其中4个模型偏左,且部分模型未意识到自身的偏见。

0 人收藏 0 人点赞
#political-bias

华盛顿邮报用于评估AI政治偏见的问题与答案完整列表

Reddit r/singularity · 2026-06-25

华盛顿邮报公布了用于评估AI模型政治偏见的问题与答案完整列表,揭示了具体的评估方法和潜在偏见。

0 人收藏 0 人点赞
#political-bias

AI聊天机器人存在政治偏见?《华盛顿邮报》测试发现:

Reddit r/singularity · 2026-06-24

《华盛顿邮报》对主流AI聊天机器人进行了测试,发现其回答中存在政治偏见,引发对AI系统客观性的担忧。

0 人收藏 0 人点赞
#political-bias

Polar:评估LLM政治偏见的基准

arXiv cs.CL · 2026-06-12 缓存

Polar是一个包含4,026个多选题的基准,用于评估LLM在美国和韩国政治背景下的政治偏见,通过选项级似然度来测量偏见。对38个LLM的实验显示,系统性偏见模式因政治背景、议题类别和呈现语言而异。

0 人收藏 0 人点赞
#political-bias

Minimax M3 似乎没有政治审查

Reddit r/LocalLLaMA · 2026-06-02

Minimax M3 模型似乎没有政治审查,在偏见基准测试中在中国的大语言模型中显得格外突出。

0 人收藏 0 人点赞
#political-bias

我测试了5个AI模型对同一新闻文章的摘要。它们都继承了原文的框架,即使试图保持中立。我是新手,请多包涵

Reddit r/ArtificialInteligence · 2026-05-30

一位用户测试了五个AI模型对移民新闻文章的摘要,发现所有模型都继承了原文的框架,看似中立,但通过强调和省略来塑造读者的理解。这项研究规模小且是探索性的,数据公开可用。

0 人收藏 0 人点赞
#political-bias

通过一致性训练减少政治操纵

Hugging Face Daily Papers · 2026-05-28 缓存

本文介绍了政治一致性训练(PCT),一种基于强化学习的方法,旨在减少大语言模型中的隐性政治偏见,同时保持其有用性,并发布了用于衡量情感一致性和有用性一致性的指标。

0 人收藏 0 人点赞
#political-bias

ChatGPT、Gemini、Claude、Grok 未能通过选举话题准确性测试:Forum AI

Reddit r/ArtificialInteligence · 2026-05-21 缓存

Forum AI 的一项研究发现,ChatGPT、Gemini、Claude 和 Grok 等主要聊天机器人未能提供准确且无偏见的选举信息,其中 90% 的回答包含错误或偏见。

0 人收藏 0 人点赞
#political-bias

德国政治文本意识形态预测

Hugging Face Daily Papers · 2026-05-14 缓存

本文提出一种基于Transformer的模型,可将德语文本的政治倾向映射到从左到右的连续频谱上,在包含德国联邦议院全体会议记录、Wahl-O-Mat、报纸和推文等多个语料库上实现了高准确率。

0 人收藏 0 人点赞
#political-bias

政治可塑性:大型语言模型中意识形态适应性的分析

arXiv cs.AI · 2026-05-12 缓存

本研究论文分析了大型语言模型中的“政治可塑性”,发现当提供用户示例时,较新的模型展现出可靠的意识形态适应性,而较旧的模型则表现出有限或不稳定的反应。

0 人收藏 0 人点赞
#political-bias

为LLM构建了一个政治基准。KIMI K2无法回答关于台湾的问题(显然)。GPT-5.3在提供选择退出选项时100%拒绝回答问题。[P]

Reddit r/MachineLearning · 2026-04-16

研究人员构建了一个开源的政治坐标基准,包含14个政策领域的98个结构化问题,用于评估前沿LLM(GPT-5.3、Claude Opus 4.6、KIMI K2)。关键发现:拒绝模式与选择退出选项显著改变了模型定位。GPT-5.3在提供选择退出选项时100%拒绝回答问题,而KIMI K2虽然在其它方面表现进步立场,但在台湾/新疆问题上表现出特定主题的审查。

0 人收藏 0 人点赞
#political-bias

定义和评估 LLM 中的政治偏见

OpenAI Blog · 2025-10-09 缓存

OpenAI 推出了一个全面的框架来定义和评估 LLM 中的政治偏见,引入了跨越 5 个偏见轴线、包含 100 个主题的 500 条提示评估。结果显示 GPT-5 模型相比之前的版本实现了 30% 的偏见减少,少于 0.01% 的生产环境中的 ChatGPT 回复存在政治偏见。

0 人收藏 0 人点赞
#political-bias

2026年4月24日公告选举安全保障措施更新

Anthropic News · 2026-05-08 缓存

Anthropic详细介绍了其确保Claude在选举期间保持公正和安全的各项举措,包括对Opus 4.7和Sonnet 4.6的偏见评估、与外部智库的合作,以及针对虚假信息的使用政策执行。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈