尧图建网站 尧图建网站 YAOTU WEB BUILD 免费咨询
ARTICLE DETAIL

资讯详情

深耕网站建设与建站编程的一线实战洞察。

Stable Diffusion 实操:3 个参数跑通草图到成图

Stable Diffusion 实操:3 个参数跑通草图到成图 Stable Diffusion 实操3 个参数跑通草图到成图【免费下载链接】stable-diffusionA latent text-to-image diffusion model项目地址: https://gitcode.com/GitHub_Trending/st/stable-diffusion评审会前夜草图画完了成品图还没出第二版。我打开终端开始干活Stable Diffusion一个基于 latent diffusion潜在空间扩散的文本到图像生成模型是我做概念设计时的连夜出稿工具。我依赖的不是模型原理而是 img2img 脚本里的 3 个参数。img2img 主流程一条命令把草图变成成品图 先把环境搭起来。克隆仓库后按仓库自带的 environment.yaml 建 conda 环境git clone https://gitcode.com/GitHub_Trending/st/stable-diffusion conda env create -f environment.yaml然后是权重把 v1 的 checkpoint权重文件建议用 sd-v1-4.ckpt放到models/ldm/stable-diffusion-v1/model.ckpt下载地址在 README.md 的 Weights 一节里写得很清楚。输入我用仓库里自带的山脉草图线条只有山体和水面两层主命令如下可直接复制运行前提权重已就位python scripts/img2img.py \ --prompt A fantasy landscape, trending on artstation \ --init-img assets/stable-samples/img2img/sketch-mountains-input.jpg \ --strength 0.8 --seed 42 --n_samples 2结果落在outputs/img2img-samples/samples/子目录里是单张图同目录还有一张 grid 汇总图方便对比。strength0.8 这一档的效果就是仓库示例里 mountains-3 那张我为什么这么调参strength 给到 0.8 是折中三层山的构图和水面位置必须保住但天空与山体细节交给模型自由发挥。如果草图线条薄、方向还没定我会先降到 0.5 试。prompt 只写风格定位fantasy landscape artstation 风格不塞具体物件。img2img 里主输入是图prompt 只是方向盘塞太满反而打架。seed 固定 42。不锁 seed 时每次跑出来的差异混着噪声差异根本分不清是哪个参数起了作用。--n_samples 2一次出两张不同噪声起点的结果挑一张继续调省一半等待。三个关键参数如下都是 scripts/img2img.py 里可以直接改的参数取值范围调大/调小的实际影响--strength0.0–1.0默认 0.75调大给原图加的噪声越多改动越剧烈逼近 1.0 构图会丢调小贴近原草图只改细节--scale0–15默认 5.0调大更贴合 prompt但易过锐化、颜色发饱和调小画风更自由构图更松--ddim_steps10–100默认 50调大细节更多但更慢快速定方向时可以压到 20–30同一张图的二次加工不用换工具两条路一是方向已定、只想精修细节把 strength 降到 0.3–0.4 再跑一遍构图基本不动相当于抛光二是只想改局部别动整图换用 scripts/inpaint.py传入xxx.pngxxx_mask.png成对文件mask 白色区域为待重绘区仓库的data/inpainting_examples/自带样例可直接跑python scripts/inpaint.py --indir data/inpainting_examples \ --outdir outputs/inpaint-samples --steps 50如果手头连草图都没有先用 scripts/txt2img.py 从纯文字生成一版底图再走上面的二次加工整条链路就闭环了。踩坑记录调参前容易翻车的三个地方 ⚠️先锁 --seed 42再动任何参数没有固定 seed 时我浪费过一个下午去归因。不锁 seed每次运行混入新的随机噪声结果变化到底是 prompt 引起还是噪声引起分不清。所有对比测试我都固定--seed 42一次只改一个变量。strength 超过 0.8 构图开始漂移我的经验上限是 0.7不建议直接摸 0.9。原因是 strength 决定给原图加噪的步数t_enc strength × ddim_steps越接近 1.0原图信息被破坏得越彻底山体位置都可能挪走。解法保构图换风格锁 0.5–0.6只留主轮廓大胆用 0.7–0.8分档试而不是跳档。scale 超过 8 画面发硬5–7 是甜区我的一般顺序是先用 scale5 看大方向满意后再拉到 7 抠细节。scale 是无条件引导的权重拉太高模型会过度服从 prompt出现白边、色块和过饱和。看到画面发硬别动其他参数先把 scale 降回 5 再看一遍。权重不会自动下载先备好再跑脚本第一步就要读models/ldm/stable-diffusion-v1/model.ckpt缺文件直接报错退出。v1 权重带使用限制仓库里既不打包也不帮你自动拉取。按 README 的 Weights 说明拿到 sd-v1-4.ckpt 后放到位或直接命名为 model.ckpt再启动能省掉一整轮排查。跑通主流程后建议先对同一张图做一次 strength0.4 的抛光档再试 scripts/inpaint.py 的局部重绘。环境与权重细节回看 README.md。【免费下载链接】stable-diffusionA latent text-to-image diffusion model项目地址: https://gitcode.com/GitHub_Trending/st/stable-diffusion创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表