arXiv cs.AI / cs.LG / cs.CL·6d agoIDRF: Inverse-Distilled Reward Fine-tuning of Masked Discrete Diffusion Models#discrete-diffusion#reward-fine-tuning#inverse-distillationAI research1