DiffusionNFT: Online Diffusion Reinforcement with Forward Process

ICLROral2026

Authors
Kaiwen Zheng, Huayu Chen, Haotian Ye, Haoxiang Wang, Qinsheng Zhang, Kai Jiang, Hang Su, Stefano Ermon, Jun Zhu, Ming-Yu Liu
Affiliation
Tsinghua University
Venue
ICLR 2026
Track
Oral

TL;DR

We propose a new online reinforcement learning (RL) algorithm for diffusion and flow models based on forward process.

Opening excerpt from the authors’ abstract. source

Read the paper

Topics

reinforcement learning diffusion

← All ICLR 2026 Oral papers · Browse the whole archive