ContextBias: 文本到图像模型中上下文转变下偏见持续性的受控评估
摘要
本文介绍了ContextBias和ContextBench,用于评估文本到图像模型中的偏见持续性,发现在语义无关的上下文中偏见会增加。
查看缓存全文
缓存时间: 2026/09/01 15:40
论文页面 - ContextBias:文本到图像模型在上下文偏移中偏见持续性的可控评估
来源:https://huggingface.co/papers/2608.29847 发布于 8月30日
·
由 https://huggingface.co/shaghayegh 提交
kolli (https://huggingface.co/shaghayegh) 于 9月1日发布
摘要
文本到图像模型在不同上下文中持续表现出与角色相关的视觉刻板印象,在无关提示下,跨角色属性集中度不降反升。
文本到图像模型(https://huggingface.co/papers?q=Text-to-image%20models)学习了概念(本文中指人们的职业,我们称之为角色)与视觉属性之间的关联。这些关联可能构成许多观察到的刻板偏见形式的基础(https://huggingface.co/papers?q=stereotypical%20bias)。该领域一个关键的开放性问题是,当专业人士角色的视觉表征被置于不同的提示上下文时,这些关联是稳定还是会改变。我们引入了 ContextBias(https://huggingface.co/papers?q=ContextBias)——一个可控评估框架,以及 ContextBench(https://huggingface.co/papers?q=ContextBench)——一个涵盖 92 个角色和 1,656 个语义可控提示的基准测试,旨在隔离上下文变化对角色相关视觉表征的影响。通过对四个最先进模型在 66,240 张生成图像上的评估,我们发现将角色置于语义无关的上下文中并不能抑制角色相关属性;相反,跨角色属性集中度(https://huggingface.co/papers?q=cross-role%20attribute%20concentration)会增加(池化 BI +0.047)。人口统计提示(https://huggingface.co/papers?q=Demographic%20cues)、特征性服装和特定角色工具在无上下文、相关和无关条件下都保持高度普遍性,并且对语义提示重构具有鲁棒性。场景构成(https://huggingface.co/papers?q=Scene%20composition)和镜头构图(https://huggingface.co/papers?q=camera%20frame)则表现出最大的上下文敏感性。这些发现揭示了一种在无上下文评估中基本不可见的刻板持久性形式,强调了在偏见基准测试中需要进行可控的上下文变化。代码和数据集:https://huggingface.co/datasets/shaghayegh/ContextBias (https://huggingface.co/papers?q=ContextBias),https://github.com/Sina-Emami/ContextBias (https://huggingface.co/papers?q=ContextBias)
查看 arXiv 页面 (https://arxiv.org/abs/2608.29847)查看 PDF (https://arxiv.org/pdf/2608.29847)添加到收藏集 (https://huggingface.co/login?next=%2Fpapers%2F2608.29847)
在您的代理中获取此论文:
hf papers read 2608\.29847
没有最新的 CLI?curl \-LsSf https://hf\.co/cli/install\.sh \| bash
引用本文的模型 0
没有模型关联此论文 在模型 README.md 中引用 arxiv.org/abs/2608.29847 以从此页面链接。
引用本文的数据集 0
没有数据集关联此论文 在数据集 README.md 中引用 arxiv.org/abs/2608.29847 以从此页面链接。
引用本文的 Space 0
没有 Space 关联此论文 在 Space README.md 中引用 arxiv.org/abs/2608.29847 以从此页面链接。
包含本文的收藏集 0
没有收藏集包含此论文 将本文添加到收藏集 (https://huggingface.co/new-collection) 以从此页面链接。
相似文章
语境之代价:在多模态检索增强生成中缓解文本偏差
本文识别并形式化了多模态RAG中的“再污染”现象,即添加准确上下文会导致模型因注意力崩溃(视觉盲区和位置偏差)而放弃正确预测。作者提出BAIR,一种无参数的推理时框架,能恢复视觉显著性并惩罚文本干扰因素,从而在医学、公平性和地理空间基准上提高可靠性。
当无关文本变得重要时:多模态大语言模型中的仿射边界移动
本文研究了无关文本上下文如何偏差多模态大语言模型中的预测,表明上下文诱导的决策边界遵循无上下文边界的仿射变换,为模型敏感性提供了见解。
HierBias:基于上下文条件的层次化媒体偏见检测与多任务类型分类
HierBias提出了一种层次化的上下文条件模型用于媒体偏见检测,利用文档上下文改进句子级分类,在BABE和BASIL数据集上达到了最先进的F1和MCC分数。
使用概念图在T2I扩散模型中的高效偏见缓解
该论文介绍了CO-ALIGN,一种用于文本到图像扩散模型的偏见缓解方法,它在文本编码器和去噪器中对齐概念图,实现了30%的公平性提升和11.4的FID增益,同时减少了88%的不连贯输出。
OptimismBench:预测语言模型判断中的偏见与对齐效应
本文介绍了OptimismBench,一个使用逆序对检测语言模型概率判断中方向性偏见的基准。研究发现大多数模型表现出乐观偏差,并且对齐(后训练)放大了这种倾向,模型身份主导了语言效应。