DALL·E 推出 outpainting 图像外扩功能
OpenAI 为 DALL·E 推出 outpainting 功能,可在原始图像之外继续生成内容,支持任意尺寸的图像扩展,帮助用户延展画面、讲述更完整的故事。
推荐理由:原文说明 DALL·E 的 outpainting 可让图像扩展到任意尺寸,读者可以据此判断它在图像创作流程中的用途。
AI 画图的最前线:文生图模型迭代、图像编辑能力与创作工具生态的全部动态。
OpenAI 为 DALL·E 推出 outpainting 功能,可在原始图像之外继续生成内容,支持任意尺寸的图像扩展,帮助用户延展画面、讲述更完整的故事。
推荐理由:原文说明 DALL·E 的 outpainting 可让图像扩展到任意尺寸,读者可以据此判断它在图像创作流程中的用途。
Hugging Face 官方博客发布教程,展示如何用 🧨 Diffusers 库运行 Stable Diffusion v1-4 文生图模型,模型由 CompVis、Stability AI 和 LAION 基于 LAION-5B 子集的 512x512 图像训练。
推荐理由:官方教程从StableDiffusionPipeline基础用法讲到自定义推理管线,读者可以按步骤复现文生图并理解潜在扩散的三个组件。
OpenAI 宣布 DALL·E 进入 beta,未来几周将从等待名单中邀请 100 万人使用。用户每月可获得补充的免费 credits,并可按 115 次生成 15 美元的价格购买额外 credits。
推荐理由:官方公布了 DALL·E beta 的邀请规模和免费加付费的信用点定价方式,有助于了解早期图像生成产品的获取门槛。
Hugging Face 发布教程,基于 Ho et al. 2020 的 DDPM 论文和 Phil Wang 的实现,用 PyTorch 逐步实现扩散模型。
推荐理由:逐行实现 Ho et al. 2020 的 DDPM,覆盖前向加噪、损失推导、U-Net 结构与采样训练全流程,便于动手理解扩散模型原理。
OpenAI 发布论文 Hierarchical text-conditional image generation with CLIP latents,介绍使用 CLIP latents 进行分层文本条件图像生成的方法。材料仅标题可用,正文未抓取到。
OpenAI 训练了名为 DALL·E 的神经网络,可从文本描述生成图像,覆盖自然语言可表达的广泛概念。
推荐理由:原文说明 DALL·E 能根据自然语言文本描述生成图像,是文本生成图像方向的早期代表工作。