04:00
2026-09-16
arxiv.org
computer-vision
Counterfactual Reasoning for Robust Visual Question Answering
A new training framework for Visual Question Answering (VQA) achieves 61.64% accuracy on the bias-sensitive VQA-CP v2 benchmark while maintaining 62.80% on the standard VQA v2 dataset, a generalizatio…