开源项目
worldbench/DiffusionOPSD:扩散模型在策自蒸馏算法的第三方训练实现
worldbench/DiffusionOPSD
概述
仓库开篇注明这是所附论文算法的外部实现。论文题为DiffusionOPSD: On-Policy Self-Distillation in Diffusion Models,主旨是以显式、持续刷新的中间目标做奖励引导的扩散模型后训练。作者阵容庞大,来自ByteDance Seed、新加坡国立大学、UC San Diego、马里兰大学、港科大(广州)、杜克大学、UC Berkeley等机构。由于并非官方代码库,超参配置与训练细节可能与论文原设定存在出入,复现论文指标时应注意核对。