西红柿、土豆和洋葱:质疑面部呈现攻击检测中对面部的需求

Hugging Face Daily Papers 论文

摘要

本文介绍了一个无面部的呈现攻击检测数据集(TPO),并证明可以在不使用面部内容的情况下学习可迁移的表示,从而提高PAD任务中的跨数据集性能。

面部呈现攻击检测(PAD)传统上被视为面部特定问题,尽管打印、重放和重新捕获过程引入的许多视觉伪影与面部外观并无固有联系。在本文中,我们研究是否可以在不使用面部的情况下,在下游PAD训练中学习可迁移的PAD表示。为此,我们引入了TPO,一个受控的无面部呈现攻击数据集,包含真实、打印和重放记录,这些记录来自几乎随机选择的西红柿、土豆和洋葱,其采集协议与常规面部PAD数据集紧密对应。基于基础模型的PAD架构,我们证明在TPO上训练的检测器在四个标准跨数据集面部PAD基准测试中平均AUC达到92.70%,优于在合成面部上训练,并与在真实面部数据集上训练的模型保持竞争力。相反,在面部PAD数据集上训练的模型在迁移到TPO时始终高于随机水平,表明学习到的表示捕获的是呈现过程的特征而非对象语义。此外,将TPO纳入常规面部PAD训练,在固定优化预算下一致提高了跨数据集性能,表明无面部数据提供了互补信息,而不仅仅是额外的训练样本。最后,表示和频率分析提供了进一步证据,表明可迁移的PAD表示无法用单一光谱伪影来解释,而是编码了跨对象类别共享的更丰富的呈现线索。总之,这些结果提供了实证证据,表明可迁移的呈现攻击表示可以独立于面部内容学习,为隐私保护和身份独立的PAD开发开辟了新机会。
查看原文
查看缓存全文

缓存时间: 2026/08/25 12:35

论文页面 - 番茄、土豆与洋葱:对人脸呈现攻击检测中是否需要人脸内容的质疑

来源:https://huggingface.co/papers/2608.21455

摘要

无人脸呈现攻击数据集能够生成可迁移的呈现攻击检测(PAD)表征,无需依赖人脸内容即可提升跨数据集检测性能。

传统上,人脸呈现攻击检测(https://huggingface.co/papers?q=presentation%20attack%20detection)(PAD)被视为针对人脸的特定问题,尽管打印、回放和重采集过程中引入的许多视觉伪影本质上与人脸外观无关。本研究探讨在PAD下游训练中不使用人脸图像时,是否仍能学习到可迁移的PAD表征。为此,我们引入了TPO——一个受控的无人脸呈现攻击数据集,包含对随机选取的番茄、土豆和洋葱进行的真人样本、打印攻击及回放攻击录制,其采集协议与传统人脸PAD数据集高度相似。

基于基础模型的PAD(https://huggingface.co/papers?q=foundation-model-based%20PAD)架构实验证明:在TPO上训练的检测器在四个标准跨数据集人脸PAD基准测试中平均AUC(https://huggingface.co/papers?q=AUC)达到92.70%,性能优于基于合成人脸的训练,并与真实人脸数据集训练的模型保持竞争力。反之,在人脸PAD数据集上训练的模型也能稳定迁移至TPO数据集,表明所学表征捕获的是呈现过程特征而非物体语义。进一步研究发现,在固定优化预算下,将TPO纳入常规人脸PAD训练能持续提升跨数据集性能,说明无人脸数据提供了互补信息而非简单的额外训练样本。最后,表征分析与频谱分析表明,可迁移的PAD表征无法用单一频谱伪影解释,而是编码了跨物体类别共享的丰富呈现线索。

这些结果共同证明,可迁移的呈现攻击表征可以独立于人脸内容进行学习,为隐私保护和身份无关的PAD技术发展开辟了新途径。

查看 arXiv 页面 (https://arxiv.org/abs/2608.21455)查看 PDF (https://arxiv.org/pdf/2608.21455)GitHub0 (https://github.com/gurayozgur/TPO)添加到收藏 (https://huggingface.co/login?next=%2Fpapers%2F2608.21455)

在智能助手中获取此论文:

hf papers read 2608\.21455

尚未安装最新CLI?curl \-LsSf https://hf\.co/cli/install\.sh \| bash

引用本文的模型0

暂无关联模型

在模型 README.md 中引用 arxiv.org/abs/2608.21455 即可从本页建立链接。

引用本文的数据集0

暂无关联数据集

在数据集 README.md 中引用 arxiv.org/abs/2608.21455 即可从本页建立链接。

引用本文的 Space0

暂无关联 Space

在 Space README.md 中引用 arxiv.org/abs/2608.21455 即可从本页建立链接。

收录本文的收藏集1

相似文章

Tactus:基于低成本压力阵列的开放词汇物体识别

arXiv cs.LG

本文介绍了Tactus,一种开放词汇触觉识别模型,将低成本压力阵列数据映射到文本嵌入,在STAG基准上仅使用187条训练记录且无分类器头的情况下,匹配甚至超过了监督式闭集CNN基线。