vision-language-alignment

标签

Cards List
#vision-language-alignment

ReVA: 用于视觉定位问答的区域感知视觉助手

arXiv cs.CL · 3天前 缓存

ReVA 引入了一个区域感知的视觉助手,通过整合全图和区域级表示,增强了视觉定位问答,并减少了多模态大语言模型中的幻觉问题。

0 人收藏 0 人点赞
#vision-language-alignment

EXPL-FR:通过视觉语言对齐解释人脸识别模型

Hugging Face Daily Papers · 2026-08-21 缓存

EXPL-FR 是一种方法,通过将视觉语言嵌入与识别空间对齐来解释人脸识别模型,从而实现语义属性的无标签审计和模型比较,而无需访问模型架构。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈