perception-bench

Tag

Cards List
#perception-bench

PerceptionBench: Evaluating Atomic Visual Perception in Multimodal Large Language Models

Hugging Face Daily Papers · 4d ago Cached

PerceptionBench is a benchmark designed to evaluate atomic visual perception capabilities of Multimodal Large Language Models (MLLMs), using a bottom-up taxonomy of ten atomic perceptual capabilities. Results across 16 frontier MLLMs show no model reaches 60% accuracy, indicating visual perception remains largely unsolved.

0 favorites 0 likes
← Back to home

Submit Feedback