D1: Scaling Reasoning in Diffusion LLMs via Reinforcement Learningdllm-reasoning.github.io·4 pts·t55·0
Block Diffusion: Interpolating Autoregressive and Diffusion Language Modelsm-arriola.com·72 pts·t55·16