visual-access-boundary

Tag

Cards List
#visual-access-boundary

Visual Access Boundaries in Vision-Language Model Reasoning

arXiv cs.AI · 2026-07-15 Cached

This paper introduces Visual Access Sweep, a causal intervention method to measure the minimal image-token access needed for Vision-Language Model reasoning, and finds that Chain-of-Thought prompting does not primarily improve performance by prolonging direct image access but by enabling extended language-side computation over visual information.

0 favorites 0 likes
← Back to home

Submit Feedback