Hugging Face Blog·· 2023-09-29AI 评分44
用 TRL 的 DDPO 微调 Stable Diffusion 模型
Finetune Stable Diffusion Models with DDPO via TRL
AI 导读
Hugging Face 介绍了如何通过 TRL 库新增的 DDPOTrainer,用强化学习方法 DDPO 微调 Stable Diffusion,使输出更符合人类审美。
来源:Hugging Face Blog · huggingface.co