跳到正文
原文
Hugging Face Blog·· 2023-09-29AI 评分44

用 TRL 的 DDPO 微调 Stable Diffusion 模型

Finetune Stable Diffusion Models with DDPO via TRL

AI 导读

Hugging Face 介绍了如何通过 TRL 库新增的 DDPOTrainer,用强化学习方法 DDPO 微调 Stable Diffusion,使输出更符合人类审美。

来源:Hugging Face Blog · huggingface.co