Documented: Weight-Level Political Conditioning in Large Language Models - A Case Study in AI Bias on the Gaza Genocide Question
Summary
This paper documents weight-level political conditioning in large language models, presenting a case study on AI bias regarding the Gaza genocide question.
Similar Articles
Inference-Time Mitigation of Adversarial Political Bias in Large Language Models
This paper proposes inference-time mitigation strategies using Chain of Thought prompting and Direct Preference Optimization to reduce adversarial political bias in large language models, demonstrating significant improvements in political neutrality scores.
The Geopolitics of AI Safety: A Causal Analysis of Regional LLM Bias
This paper introduces a Probabilistic Graphical Model framework to causally audit LLM safety mechanisms, revealing that standard observational metrics overestimate demographic bias by ignoring context toxicity.
Polarization by Default: Auditing Recommendation Bias in LLM-Based Content Curation
This paper presents a large-scale audit of recommendation biases in LLM-based content curation across OpenAI, Anthropic, and Google using 540,000 simulated selections from Twitter/X, Bluesky, and Reddit data. The study finds that LLMs systematically amplify polarization, exhibit distinct toxicity handling trade-offs, and show significant political leaning bias favoring left-leaning authors despite right-leaning plurality in datasets.
Testing GLM 5.2 on Political Bias
Testing the GLM 5.2 language model for political bias to assess fairness and neutrality.
Computational Orientalism: Measuring Structural Discourse Bias in Large Language Models Using the Middle East Cultural Sensitivity Score (MECSS)
This paper introduces the Middle East Cultural Sensitivity Score (MECSS) to measure Orientalist bias in large language models, finding that GPT-4 and Falcon3-7B-Instruct systematically reproduce such structural patterns.