Tag
This paper investigates how American English becomes the default in large language models, examining structural bias across pretraining data, tokenization, and generation stages through a controlled study with American and British English variants.