dialect-bias

Tag

Cards List
#dialect-bias

From a River in Gilead to the Inference Distributions of Large Language Models: Covert Dialect Bias and Linguistic Profiling at Scale

arXiv cs.CL ↗ · 2026-09-17 Cached

This paper examines covert dialect bias in large language models by analyzing their internal probability distributions across four English dialects, finding that models associate more negative housing-related adjectives with African American Vernacular English and Nigerian Pidgin, reflecting inherited biases similar to human discrimination.

0 favorites 0 likes
#dialect-bias

LLMs Silently Correct African American English: Auditing and Mitigating Dialect Bias via Activation Steering

arXiv cs.CL ↗ · 2026-07-09 Cached

This paper audits and mitigates dialect bias in large language models, showing they systematically prefer Standard American English over African American English. The authors introduce activation steering, a training-free method that reduces bias significantly while preserving fluency, and release the largest real-AAE parallel corpus to date.

0 favorites 0 likes
#dialect-bias

Side-by-side Comparison Amplifies Dialect Bias in Language Models

arXiv cs.CL ↗ · 2026-05-26 Cached

This research paper finds that language models exhibit increased dialect bias when comparing Standard American English and African-American Vernacular English side-by-side, even after safety fine-tuning. Counterfactual fairness fine-tuning can reduce some biases in isolation but not consistently in contrastive settings.

0 favorites 0 likes
← Back to home

Submit Feedback