多模态大模型实战9
第9章 Stable Diffusion与FLUX——文本生成图像实战学习目标理解Diffusion模型的原理(前向加噪、反向去噪)掌握Stable Diffusion架构(VAE + U-Net + Text Encoder)完成SD实战:文生图、图生图、Inpainting了解FLUX架构及其优势9.1 Diffusion模型原理前向过程:加噪逐步向图像添加高斯噪声,直到变成纯噪声。x_0 → x_1 → x_2 → ... → x_T(纯噪声)数学表示:q(x_t | x_{t-1}) = N(x_t; √(1-β_t) * x_{t-1}, β_t * I)β_t:噪声调度参数,从小到大t=0是原图,t=T是纯噪声反向过程:去噪训练神经网络预测噪声,从纯噪声逐步去噪恢复原图。importtorch