Do Audio Language Models Use Paralinguistic Evidence? Counterfactual Audits for Response Evaluation
A new study from arXiv (2608.06718v1) introduces counterfactual audits for paralinguistic response evaluation, finding that audio-language models (ALMs) such as Gemini, GPT, and open audio models often fail to use parali…