d1: Scaling Reasoning in Diffusion Large Language Models via Reinforcement Learning

NeurIPSSpotlight2025

Authors
Siyan Zhao, Devaansh Gupta, Qinqing Zheng, Aditya Grover
Venue
NeurIPS 2025
Track
Spotlight

TL;DR

Recent large language models (LLMs) have demonstrated strong reasoning capabilities that benefits from online reinforcement learning (RL)

Opening excerpt from the authors’ abstract. source

Read the paper

Topics

reinforcement learning large language model language model diffusion reasoning llm

← All NeurIPS 2025 Spotlight papers · Browse the whole archive