ComfyUI 从安装入门到精通,图生图实战(改风格/换构图/出变体)

ComfyUI 从安装入门到精通,图生图实战(改风格/换构图/出变体)

前面七篇,你已经能从零装好、出图、调质量、自救报错了。但有个问题:每次都从一段文字提示词硬”憋”出图,想要某个构图、某个姿势,纯靠文字怎么都描述不准。

这时候就得用图生图(img2img)了。我当初发现这功能,简直打开新世界——拿一张现成图当”底子”,让 AI 在上面改,比从零瞎猜提示词高效十倍。这篇手把手教你:图生图咋回事、降噪强度怎么调、三个实战场景直接抄。

一、图生图到底啥原理

一句话:图生图 = 文生图 + 一张参考图。文生图是”从噪声里凭空画”;图生图是”先把你的图编码进潜空间,再在这基础上重新生成”。关键节点链:

Load Image(载入你的图)
→ VAE Encode(编码进潜空间) ← 图生图独有
→ KSampler(latent_image 接这里,非 Empty Latent)
→ VAE Decode
→ Save Image

最关键的坑:KSampler 的 latent_image 接的是 VAE Encode 的输出,绝不是文生图那个 Empty Latent Image。我见过新手把原图直接连 KSampler,结果全是噪声——像素图没经 VAE 编码,AI 当纯噪声处理了。原图必须经过 VAE Encode 才能喂给 KSampler。

二、降噪强度 Denoise:灵魂旋钮

denoise 决定”保留原图多少”。0 = 原图一点不动,1 = 完全噪声替换(等于文生图)

区间
效果
适合
0.2~0.3
微调/轻度美化
高清修复、老照片修复
0.3~0.5
小幅改风格、保构图
换滤镜/风格迁移
0.5~0.7
平衡,构图还在
垫图/变体/照片转风格
0.6~0.8
大幅重绘、换材质
大改画风/线稿上色
0.8~1.0
基本重画
接近文生图

想”同图换画风”,denoise 设 0.4 最舒服——构图还在、风格全变。新手先从 0.5 试,每次调 0.1。SDXL 和 Flux 有差异:Flux 潜空间压缩比更高,可用 0.8~0.95;SDXL 更宜 0.2~0.4。

踩坑经历:我第一次用图生图设了 denoise=0.1,出来的图和原图几乎一模一样,还以为工作流坏了。后来才懂——denoise 越低 AI 改得越少,0.1 基本等于没改。

三、手把手搭一条图生图链

和第05篇基础文生图比,只多 Load Image + VAE Encode 两个节点。
1. 加 Load Image:选底图(或拖图进节点)。
2. 加 VAE Encode:Load Image 的 IMAGE 连 pixels,Checkpoint 的 VAE 连 vae。
3. 加 KSampler:VAE Encode 的 LATENT 连 latent_image(重点!不是 Empty Latent),denoise 先设 0.5。
4. 加 VAE Decode + Save Image:同文生图。
5. 开跑:Queue Prompt。

实操闭环:10 分钟,拿你的照片改个赛博朋克风(现在就做)

前面讲原理和搭链,这段真刀真枪做一遍。做完你多一张”自己的照片变赛博朋克”的图,还能确认图生图真生效。

前提:你已有第05篇基础文生图工作流(Load Checkpoint → 两个 CLIP Text Encode → KSampler → VAE Decode → Save Image)。丢了重搭一遍。
目标:拿一张自己的照片改成赛博朋克风,且保留原图姿态构图。

步骤(照着点,别跳):
1. 备图:找张自己的照片(人像最好),放桌面。
2. 加 Load Image:画布双击空白 → 搜 Load Image → 回车 → 点节点 “choose file” 选照片(或拖图进节点)。
3. 加 VAE Encode:Load Image 的 IMAGE 连 pixels,Checkpoint 的 VAE 连 vae。
4. 改接线(最关键):拔掉 KSampler 原接的 Empty Latent,改接 VAE Encode 的 LATENT → latent_image;denoise 设 0.6。
5. 写提示词:正向 cyberpunk style, neon lights, rain, city street, masterpiece, best quality;负向留空或 blurry, low quality。
6. 出图:点 Queue Prompt。

检查点(你跑完应该看到):

① 还是”你”的姿态构图、脸的位置,但色调背景光影全变赛博朋克;

② 一团噪声 → 八成 KSampler 还接 Empty Latent,没换成 VAE Encode 输出(回第三节坑);

③ 和原图一模一样 → 八成 denoise 太低(<0.2),拉回 0.6。

作业(选做):同一张照片,denoise 分别设 0.3 和 0.8 各跑一张对比。0.3 是”淡淡改色”,0.8 是”大改画风只留轮廓”——一下就把 denoise 旋钮摸透了。

四、三个实战场景(提示词直接抄)

原理和搭链都会了,下面三个最常用场景,提示词和参数都写好了,照着改你自己的图。

场景一:照片转艺术风格(赛博朋克)

正向:cyberpunk style, neon lights, rain, city street, masterpiece, best quality
denoise 0.6(保人物构图,改色调背景);dpmpp_2m + 20 步 + karras + CFG 7.5。效果:姿态构图保留,色调光影全变赛博朋克。

场景二:线稿上色

正向:colored, vibrant colors, anime style + 具体颜色。
denoise 0.7~0.8(保线条、加新颜色);建议二次元底模。提示词越具体越好,”蓝眼、红裙、金发”比”彩色”强得多。

场景三:老照片修复 / 变清晰

正向:high resolution, sharp, detailed face, restored photo
负向:blurry, low quality, damaged, scratch, noise
denoise 0.2~0.3(最低档,设高会改没老照片特征);配第06篇高清放大更好。

还能玩:垫图(草图当底子 denoise 0.5~0.7 出精细图)、变体(同提示词 0.35~0.7 出几版挑最好)、局部重绘(Mask 白色=要改区,下篇细讲)。

五、参数速查表(照场景抄)

场景
采样器
步数
CFG
Denoise
细节修复
dpmpp_2m
20
7
0.2~0.3
照片换风格
dpmpp_2m
20
7.5
0.5~0.6
线稿上色
euler
25
8
0.7~0.8
创意大改
dpmpp_2m_sde
30
8
0.8~0.9
老照片修复
dpmpp_2m
20
7
0.2~0.3

六、4060 / 8G 技巧 & 我踩的坑

技巧:显存≈分辨率²,8G 底图从 512×512 起步,要高清先小图出再放大;denoise 别太高省时;采样器用 Euler / LCM 更轻快。

坑:① denoise=1 白费原图,等于文生图;② 尺寸和模型不匹配会变形,先缩放裁剪原图;③ 混淆 denoise 和 CFG,前者管保留原图多少、后者管听提示词多少。

图生图会了,你能拿任何图当跳板。接下来第09篇LoRA 使用实战——怎么选、下、放、串权重,让”装机→出图→管模型→换风格”最短闭环彻底打通。

声明:内容来源公开的各类媒体平台,若收录的内容侵犯了您的权益,请联系邮箱,本站将第一时间处理。
教程百科

ComfyUI 从安装入门到精通,报错自救(读懂红字 + 常见错误逐步解法)

2026-8-16 9:45:01

资讯

OpenAI:GPT-5 将会多合一,集成各种产品

2025-5-19 11:26:27

搜索