论文研究普通
DiffusionOPSD:扩散模型的在线策略自蒸馏框架
原始标题:On-Policy Self-Distillation in Diffusion Models
内容摘要
DiffusionOPSD 提出一种在线策略自蒸馏框架,将图像级奖励引导转化为采样查询点上干净输出预测的显式目标。在 SD 3.5-M 和 Z-Image-Turbo 上,该方法在 20 个奖励匹配设置中的 19 个取得最佳最终留出分数,相比最强竞争方法最高提升 44.0%,训练 GPU 小时数较 DiffusionNFT 分别减少 40% 和 63%。
内容分类AI 论文与研究
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源HuggingFace Daily Papers(社区热门论文)
站内情报编号intel-55a5078635e7c98908030280