vision-language-alignment

Tag

Cards List
#vision-language-alignment

ReVA: A Region-Aware Visual Assistant for Visually Grounded Question Answering

arXiv cs.CL · 3d ago Cached

ReVA introduces a region-aware visual assistant that enhances visually grounded question answering by integrating whole-image and region-level representations, reducing hallucinations in multimodal large language models.

0 favorites 0 likes
#vision-language-alignment

EXPL-FR: Explaining Face Recognition Models via Vision-Language Alignment

Hugging Face Daily Papers · 2026-08-21 Cached

EXPL-FR is a method that explains face recognition models by aligning vision-language embeddings to the recognition space, enabling label-free auditing of semantic attributes and model comparison without requiring architecture access.

0 favorites 0 likes
← Back to home

Submit Feedback