PowerBench: Measuring Language Model Bias in Power-shifting Requests
A new arXiv paper, arXiv:2610.02303v1, introduces PowerBench, an open-source benchmark that measures how language models handle power-shifting requests across self-empowerment, disempowerment, and pow…