Inference-Time Mitigation of Adversarial Political Bias in Large Language Models
Researchers propose inference-time mitigation strategies using Chain of Thought prompting and Direct Preference Optimization to shield large language models from adversarial political bias, raising Po…