AGVBench:面向可靠性的静脉识别数据增强基准测试
摘要
AGVBench是一个面向可靠性的静脉识别数据增强基准测试,评估了多个数据集和骨干网络上的30种增强策略,揭示了准确性与安全性之间的解耦。
查看缓存全文
缓存时间: 2026/07/03 11:54
论文页面 - AGVBench:一个面向可靠性的静脉识别数据增强基准
来源:https://huggingface.co/papers/2607.02271 TL;DR:我们开源了 AGVBench,这是首个面向可靠性的静脉识别数据增强基准。通过在 5 个公开的掌静脉和指静脉数据集上,使用 7 种骨干架构系统评估 30 种代表性增强策略,我们证明了仅依赖以准确率为中心的评估不足以衡量生物识别系统的可靠性。
image (https://cdn-uploads.huggingface.co/production/uploads/66aa39349238d9c3a1c7f9dc/USCrsFlloCGzKs5kJylcB.png)
📌 关键发现:
🔹 准确率–安全性解耦:多图像混合方法(如 MixUp 和 PuzzleMix)通常能取得最强的识别性能,然而它们往往校准不佳且更容易受到对抗扰动的影响,这揭示了干净准确率与对抗安全性之间的明显不一致性。
🔹 几何变换导致的性能下降:严重的几何变换会持续降低识别性能,其原因很可能是特征未对齐或空间裁剪,而非直接破坏静脉拓扑结构。
🔹 模态差异:增强策略的有效性在掌静脉和指静脉数据集上存在显著差异,表明没有任何单一增强策略能够普遍适用于不同的静脉模态。
🚀 超越基准测试,AGVBench 旨在作为面向可靠性的静脉识别的开放研究平台,促进可复现评估,启发下一代增强算法的开发,并推动可信生物识别系统在实际应用中的部署。
🏠 项目页面:https://advance-veintech-innovators.github.io/AGVBench/
📄 ArXiv 论文:https://arxiv.org/abs/2607.02271
💻 代码与基准:https://github.com/Advance-VeinTech-Innovators/AGVBench
相似文章
VEFX-Bench:通用视频编辑与视觉特效的全方位基准
VEFX-Bench 引入了一个大规模人工标注的视频编辑数据集(5,049个样本),包含多维质量标签,以及一个专门用于标准化评估视频编辑系统的奖励模型。该论文针对AI辅助视频创作中缺乏全面基准的问题,提供了VEFX-Dataset、VEFX-Reward和一个300个视频提示对的基准测试,揭示了当前编辑模型中的差距。
MSAVBench:迈向多镜头音视频生成的全面可靠评估
MSAVBench是首个面向多镜头音视频生成的综合基准与自适应评估框架,评估了19个模型在多样化任务上的表现,并与人类判断实现了高度对齐。
VIABench:一项由视障人士收集的全面视频基准,用于视觉障碍辅助
介绍了VIABench,这是一个全面的视频基准,用于评估多模态大语言模型在真实世界中对盲人和视障人士的视觉辅助能力,涵盖了761个视频和14,526个标注,涉及三个任务。
识别与解决知识型VQA基准测试的陷阱:审计、修复与增强
本文对知识型VQA基准进行了审计,揭示了系统性的假设违反,使得准确率成为误导性指标。它提出了一种修复协议和多实体增强方法,以恢复答案可推导性和问题清晰度,表明修正后的设置产生了显著不同的模型排名。
从场景到元素:可验证多模态RAG的多粒度证据检索
本文介绍了GranuVistaVQA,一个带有元素级注释的多模态基准,以及GranuRAG,一个将视觉元素视为可验证多模态RAG的一等检索单元的框架,相较于基线实现了高达29.2%的提升。