Privacy Without Regret: Differentially Private Inference-Time Alignment
Researchers introduced Private Best-of-N (PrivBoN) and Private Inference-Time Pessimism (PrivITP), two differentially private inference-time alignment methods that add calibrated noise to reward score…