先把基础分辨率提上去
Stable Diffusion 生成图片模糊,最常见的原因就是出图分辨率太低。SD 1.5 系列模型原生训练分辨率是 512×512,SDXL 是 1024×1024,如果你直接用 512×512 出图,放大到屏幕或打印时自然会发虚。解决办法很直接:把宽度和高度调到模型的原生尺寸附近。用 SD 1.5 时建议 512×768 或 768×512,横竖构图按需切换;用 SDXL 时直接上 1024×1024。但要注意,尺寸不能无脑拉高,SD 1.5 超过 768 后容易出现人物重影、结构崩坏,SDXL 超过 1536 也可能失控。所以第一步是把基础尺寸设到合理范围,而不是一步到位拉到 4K。
用 Hires Fix 做二次放大
只靠调大基础分辨率,画面细节并不会凭空变多,这时候就要用 Hires Fix(高清修复)。它的逻辑是:先按正常尺寸生成一张图,再把这幅图放大到目标尺寸,同时用较低的重绘幅度重新采样一遍,补回细节。在 WebUI 里,勾选 Hires. fix 后会出现 Upscaler、Hires steps、Denoising strength 等选项。第一遍生成尺寸填 512×768,放大倍数填 2,最终就得到 1024×1536。放大倍数建议控制在 1.5 到 2 之间,超过 2 容易出现涂抹感和畸变。Hires steps 设成 15 到 20 就够,不用和第一遍一样多。
放大算法选 ESRGAN 或 4x-UltraSharp
Hires Fix 里的 Upscaler 决定了放大后的锐度和质感。默认的 Latent 算法容易让画面变糊、产生噪点,不推荐。优先选 ESRGAN,它在保细节和去模糊之间比较均衡,适合人像和写实场景。如果你追求更锐利的线条和更清晰的纹理,可以装 4x-UltraSharp,这个算法放大后边缘更干净,对建筑、产品、插画类题材效果明显。把下载的模型文件放进 models/ESRGAN 目录,重启后在 Upscaler 下拉框里就能选到。这两个算法选一个即可,不必纠结,效果差异远小于重绘幅度带来的影响。
重绘幅度控制在 0.3 到 0.5
Denoising strength(重绘幅度)是 Hires Fix 里最关键的参数,直接决定放大后是变清晰还是变崩坏。它表示第二遍采样时改动原图的程度:设成 0.2,画面几乎不变,模糊也补不回来;设成 0.3 到 0.5,模型会在保留原本构图的前提下补足细节,这是最稳的区间;一旦超过 0.6,模型开始大幅重画,人物脸型、手指、背景结构都可能被改得面目全非,也就是常说的崩坏。写实人像建议 0.3 到 0.4,插画和二次元可以到 0.45 到 0.5。如果放大后发现画面偏软,优先小幅提高重绘幅度,而不是一味加大放大倍数。
配合提示词和模型一起优化
除了以上参数,模糊有时也来自提示词本身。在正向提示词里加入 highres、sharp focus、detailed texture、8k 这类词,能引导模型往清晰方向走;负面提示词里加上 blurry、blurry background、low quality、jpeg artifacts,能压掉糊感。另外,底模的选择也很重要,一些主打写实的模型本身出图就更锐利,换模型往往比调参数见效更快。把这几点和前面的分辨率、Hires Fix、放大算法、重绘幅度结合起来调,基本能解决绝大多数出图模糊的问题。