PerceptionBench: Evaluating Atomic Visual Perception in Multimodal Large Language Models
Researchers introduce PerceptionBench, a benchmark designed to evaluate atomic visual perception in multimodal large language models (MLLMs), finding that no model reaches 60% accuracy across ten atom…