
上篇(第03篇)ComfyUI 从安装入门到精通,模型与插件管理(放哪/去哪下/一键装) 教了你模型文件放哪、去哪下、怎么用 Manager 一键装插件。这篇咱们解决一个新手最容易犯懵的问题:底模到底选哪个?
我当初就是卡在这一步。装好 ComfyUI 一打开,模型站里几千个模型,名字一个比一个唬人,什么 SDXL、Flux、Pony,还有各种 XL、Turbo……我脑子一热,看哪个参数大下哪个,结果第一个下的就是个满血大模型,4060 直接显存爆了,红字刷了一屏。这篇就是把我自己踩过的坑、后来摸清楚的门道,一条条讲给你。
一、先把”模型”这词掰扯清楚
很多新手以为”模型”就是一个文件,其实 ComfyUI 里至少有四种东西都叫”模型”,作用完全不同。我用一个做菜的比喻:
|
|
|
|
| Checkpoint 底模 |
|
|
| LoRA 叠加包 |
|
|
| VAE 解码器 |
|
|
| Embedding |
|
|
这篇咱们主要聊 Checkpoint(底模)怎么选,因为底模选错了,后面全白搭。LoRA 和 VAE 后面专门讲。
二、四大主流底模,一张表看明白
|
|
|
|
|
|
| SD1.5 |
|
|
|
|
| SDXL |
|
|
|
|
| Pony |
|
|
|
|
| Flux |
|
|
|
|
记住两个关系,别被名字绕晕:① Pony 不是新架构,是在 SDXL 基础上微调的,用法和 SDXL 基本一致,只是更偏二次元。② Flux 是另一条技术路线(DiT),画质天花板高,但特别吃显存,新手先别碰满血版。
三、重点:8GB 显存(RTX 4060)怎么选
这是咱们读者最关心的。我自己的机器就是 4060(8G 显存),下面是我实测下来的结论:
1. SDXL 是甜点区,首选它。一个 fp16 版约 6.9GB,加上 VAE 和推理临时占用,8GB 刚好能跑 1024×1024,出一张图大概一两分钟。画质、速度、显存三者平衡得最好,新手闭眼入 SDXL 不会错。
2. Flux 能跑但慢,慎选。满血 Flux 拆开都 23GB,8G 直接爆。但可以用 GGUF 量化版:Q4 约 6.5~6.8GB、Q5 约 8GB。我试过 Q4 在 4060 上能出图,但得开–lowvram 把部分运算丢给内存,一张图要一分多钟,还容易出小问题。建议:把 SDXL 玩熟了,再回来试 Flux 量化版。
3. Pony 适合画二次元。8GB 能出 1024×1024,叠多个 LoRA 时会吃紧。主要想画动漫角色、保持角色长相一致,Pony 比 SDXL 更对路。小坑:Pony 要在 CLIP Text Encode 里设 clip_skip=2 ,不然容易出”糊成一团”的图。
4. SD1.5 适合快速试错和动画。才 2~4GB,4GB 显存都能跑,出图飞快。画质不如 SDXL/Flux,但用来快速测工作流、做动画原型很方便。我到现在还留着一个 SD1.5 当”测试机”。
四、去哪下最稳(国内优先)
|
|
|
|
|
|
LiblibAI(哩布)/ GitCode AI |
|
|
|
Civitai / HuggingFace |
|
|
|
hf-mirror.com |
|
下的时候看后缀是.safetensors 或 .ckpt,放进 omfyUI/models/checkpoints/,回 ComfyUI 点 Refresh 就能在 Load Checkpoint 下拉里看到(放哪忘了看第03篇)。
五、新手起步清单(照着下这三个就够)
别一上来囤几十个模型,又占硬盘又挑花眼。我建议你先下这三个,覆盖大部分场景:
1. SDXL 基础底模(搜 sd_xl_base_1.0):通用入门,什么风格都能试。
2. Pony Diffusion V6 XL(搜这个名字):专门画二次元、角色一致。
3. 一个写实人像底模(搜 Realistic Vision 或 Juggernaut XL 这类 SDXL 系写实模型):想画真人质感时用。
就这三个,先把 ComfyUI 跑顺了,后面再根据喜好慢慢加。模型不在多,在顺手。
六、我踩过的坑,省你两小时
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
模型选好了也下好了,但怎么把一堆节点连起来变成一张能看的图?第05篇我手把手教你看懂工作流、自己搭一条出图流水线,还会讲怎么保存和复用你调好的工作流。