07:00
2026-08-11
research.nvidia.com
artificial-intelligence
Why and When Visual Token Pruning Fails? A Study on Relevant Visual Information Shift in MLLMs Decoding
A new study identifies Relevant Visual Information Shift (RVIS) during decoding as the primary cause of performance degradation in visual token pruning methods for Multimodal Large Language Models (MLโฆ