# iADD: Improving Alignment and Diversity in Diffusion Policy Optimization

> Source: <https://aiflash.com/news/132142/>
> Published: 2026-10-06 16:30:07+00:00

Reinforcement learning based post training of diffusion models, such as Denoising Diffusion Policy Optimization (DDPO), optimizes a reverse diffusion process under a reward function. However, current approaches to reward optimizations do so at the cost of diversity and quality. In this paper, we pro
