每日签到 地址发布 老王说明书 宣传中心 繁/简
只准发布ai使用工具、基座模型、教程资源类,禁止发布app广告

一起研究怎么用ai搞涩涩
查看: 25.2W|回复: 463
收起左侧

[基座模型] comfyui图像类模型及工作流分享(2026.03.07更新)

    [复制链接]
发表于 2025-10-12 08:08:08 | 显示全部楼层 |阅读模式

马上注册,结交更多好友,享用更多功能,让你轻松玩转社区。

您需要 登录 才可以下载或查看,没有帐号?免费注册

x
本帖最后由 wulesoicq 于 2026-3-7 18:07 编辑

郑重声明

所有模型权重均来自网络。不对您生成的内容主张任何权利,赋予您自由使用的权利,同时确保您的使用符合本许可的规定。您需完全负责对模型的使用,不得分享任何对个人或群体造成伤害、传播旨在伤害的个人信息、散布错误信息或针对弱势群体的内容。有关限制的完整列表及您的权利详情,请参阅许可证全文
本文所有图片资料均为AI生成,旨在学习分享人工智能前沿技术和现实人物无任何联系!!!
*************************************************************************


以后图像生成的工作流分享新模型的更新都会放在这个贴子里,先从最基础的开始。
为了方便想入门的萌新小伙伴过渡使用,特别做了个基础版的comfyui整合包,基础的工作流都能用。但是想玩好comfyui还是要学会自己部署环境


整合包版本
Python version: 3.12.10
pytorch version: 2.8.0+cu128
ComfyUI version: 0.3.64
ComfyUI frontend version: 1.27.10
请更新显卡驱动,要支持cuda12.8



comfyui 纯新手教学 第一期 (comfyui环境部署)
comfyui 纯新手教学 第二期 (comfyui插件安装)


现在主流的AI图像生成模型有黑森林工作室的FLUX系列模型和阿里巴巴的Qwen-Image系列模型(包括传统模型以及编辑模型),它们各有优缺点。


FLUX模型细节更加丰富,开源时间比较早社区生态支持比较完善。但构图的精确性和对提示词遵循能力有所欠缺。人物皮肤过于油腻有明显的塑料感,黑森林官方微调的krea模型在这方面有了很大的改善,而且光影色彩方面也有了很大的提升,更接近摄影作品可以说是目前人像摄影真实性及美学特征最好的模型。
Qwen_Image模型在构图和对提示词遵循能力有明显的加强。有很强的中文图文编辑能力。但在诸如人物面部及肌肉线条,光影色彩等很多细节方面都有所不足,这可能和Qwen_Image训练时使用的素材中,AI生成的图片太多真实的摄影作品不足的原因有关。



我们来看看这些模型对简单的成人内容提示词出图效果
  1. 一位年轻的东亚女性表情平静的直视镜头,仅穿着一件紧贴其丰满胸部的时尚露脐上衣,下半身赤裸。
  2. 她坐在一张简约的淡蓝色沙发上,双腿大大张开,露出阴道。
复制代码

FLUX DEV
dev.jpg
我们可以看到FLUX dev模型生成的图明显小腿到脚的部位的解剖结构有明显的问题


FLUX KREA
krea.jpg
FLUX krea模型双腿没有分开,而其穿着内裤。说明krea模型对露出阴道不理解。


Qwen_Image
Qwen_Image.jpg
Qwen_Image基本遵循了提示词,也露出了阴道,只是阴道的细节错误,这说明模型训练的时候阴道的具体外观是应该是做了处理的。所以模型理解了露出阴道这个提示词,但在出图的时候无法绘制阴道的详细外观细节。


这段提示词的前半段,3个模型理解和表现的都不错
关键是
  1. 双腿大大张开,露出阴道
复制代码

这段提示词模型的理解和表达出了问题。所以我们就需要一个学习过“双腿大大张开,露出阴道”这一概念的微调Lora模型。
我们就那Real PS 这个lora来尝试,这个lora的训练数据集包含 13,000 张图片(3,000 张来自世界各地顶尖摄影师的时尚照片、10000 张色情照片)。
FLUX DEV
dev real_ps.jpg
FLUX KREA
krea real_ps.jpg
Qwen_Image
Qwen_Image real_ps.jpg


可以看出使用了这个Lora有所改善
举这些例子的目的是我想说明Lora的基本作用就是新增或优化模型的某些性能
比如性爱的姿势特殊的服装,或者是某些自己喜欢的角色。就像是游戏的MOD。这类模型在开源社区非常多,自己训练也不困难。
没有哪个Lora是万能的,如果你有耐心可以尝试搭配多个Lora,并调整Lora的强调,获得一个不错的组合。
不是去使用那种融合很多Lora的所谓NSFW模型,那种模型往往是把很多Lora调整到一个较低的强度然后融合起来。
生图的风格和人物外貌等都和模型有密切关联,所以挑选或是制作自己喜欢的Lora,才能创作出符合自己审美的作品。


好了我们简单的解释了几个主流模型的优缺点,和Lora的作用接下来我们将具体的介绍模型时如何在Comfyui中通过工作流来实现各种不同的效果的。
在Comfyui中扩散模型生图的流程其实可以简化为三步,各种模型和工作流都大同小异。
无非是模型选择和加载,文本和图像嵌入,采样降噪出图。


模型选择和加载
comfyui适用的模型格式主要有safetensors格式  或者是llama.cpp的gguf 格式
一般我们娱乐显卡会使用fp8.safetensors或者GGUF 8bit 量化的Q8_O模型。
我们来看下一般FLUX生图需要的模型,我比较喜欢写实摄影风格所以我就选择了flux1-krea-dev-Q8_0.gguf官方原版的主模型,和Real PS这个Lora 来作示范。
如果喜欢网红脸又懒的找角色Lora可以尝试下flux1-dev-fp8-麦橘超然_v.1.0.safetensors,这模型可以当做一个大号的角色Lora来用。


ComfyUI/
├─── models/
│      ├─── unet/
│      │      └───  FLUX/
│      │               └─── flux1-krea-dev-Q8_0.gguf(扩散模型:用来采样降噪,各种FLUX的扩散模型都要放在这里)
│      ├─── text_encoders/
│      │      └───  FLUX/
│      │               ├─── clip_l.safetensors
│      │               └─── t5xxl_fp16.safetensors(文本嵌入模型:将文本转换成高维向量嵌入到模型降噪中)
│      ├─── vae/
│      │      └───  FLUX/
│      │               └─── vae_FULX.safetensors(vae模型:将像素图像压缩成潜空间图片,或者将潜空间图片解压到像素图片)
│      ├─── upscale_models/
│      │      └─── 4xNomos8kSCHAT-S.safetensors(图像放大模型:放大图像,有很多可以选择这只是举个例子)
│      ├─── controlnet/
│      │      └───  FLUX/
│      │               └─── FLUX.1-dev-ControlNet-Union-Pro-2.0-fp8.safetensors(控制模型)
│      ├─── loras/
│      │      └───  FLUX/
│      │               └───  加速/
│      │                        └─── FLUX_Hyper--dev-8steps-lora(0.125).safetensors
│      │               └─── 各种Lora.safetensors


扩散模型有很多微调版本都是通用的,可以根据自己的需要选择。


为了方便低显存的小伙伴,模型加载我没有用官方的模型加载节点而是使用了MultiGPU插件。请根据自己显存的容量设置相应的virtual_vram_gb的值。
打开工作流
打开工作流.png *************************************************************************
FLUX模型生图
节点组选择,停用FLUX控制文生图节点组,图像加载节点组
文生图停用节点.png.png
在FLUX模型加载节点组中选择好需要的模型
模型加载.png
模型选择.png
在文本嵌入节点组中输入提示词
文生图文本嵌入.png
  1. A young Asian woman with soft black hair and fair skin stands in a sea of golden wheat.
  2. The setting sun cast its light on her face from the side.
  3. Her almond-shaped eyes gazed softly at the camera, her expression quiet and contemplative.
  4. She is completely naked, exposing her breasts. Her legs are slender, revealing her vagina.
  5. The background blurs into a dreamy haze, with swaying stalks bathed in the sunset glow and distant hills silhouetted against the horizon. Cinematic quality, realistic style.
复制代码
在图像嵌入节点组中输入图像尺寸
文生图图像嵌入.png
调整K采样器参数
主要参数:
步数:FLUX模型文生图我们一般选择20-30步的采样步数,图生图我们一般选择10-15步的采样步数
CFG:FLUX模型CFG为1.0。
采样器:采样器和调度器的搭配有很多选择,而且新的试验性质的采样器也层出不穷,有些搭配组合在特定的内容上会有不错的表现但也会有一定的局限性。对于新手小伙伴来说可以选择比较安全的采样器euler。
调度器:simple或beta调度器和euler 采样器搭配是一种比较安全的选择。
文生图采样.jpg


文生图细化采样.jpg
文生图示例.jpg
*************************************************************************
控制文生图
根据已有的图像的构图创作新的图像,虽然现在有了很好用的编辑模型,但这种通过控制网生图的方式还是有一定用武之地。
有的时候我们没有创作思路的时候我们可以借鉴现有的图像。
比如这张图
控制生图示例.png
这张图描述的主要内容(可以通过视觉模型,反推图片的内容)


  1. A young woman with dark short hair and bangs.
  2. She stands in front of a wooden door, her body slightly turned to the side.
  3. The woman is wearing a thong tied at the chest with a cord, the light-colored cord wrapped around her neck and shoulders.
  4. She has a serious expression, looking directly at the camera. The background is dark and blurred.

  5. 一位留着深色头发的年轻女子。
  6. 她站在一扇木门前,身体微微侧转。
  7. 女子身着用绳索系于胸前的丁字裤,那根浅色材质的绳索缠绕在她的颈部和肩头。
  8. 她神情严肃,直视镜头。背景昏暗且虚化。
复制代码

我们如果用提示词直接生图
控制生图不添加控制.jpg
我们会发现很难精确描述绳子的捆缚形态,而模型也可能没有这方面的训练,所以我们得到图很不理想
这种情况下我们就需要使用控制网
用深度控制
控制生图深度.jpg
用线条控制
控制生图线条01.jpg
首先我们用图像预处理工作流对图像进行预处理
⚠️图像预处理模型又多又杂,我统一打包成ckpts.7z,注意解压后要放在插件文件中的comfyui_controlnet_aux文件夹内,而不是model文件夹,文件路径如下:


ComfyUI/
├─── custom_nodes/
│         ├─── comfyui_controlnet_aux/
│         │      └───  ckpts/
│         │               ├───  bdsqlsz/
│         │               ├───  depth-anything/
│         │               ├───  hr16/
│         │                   .
│         │                   .
│         │                   .


我们上传图片,然后运行工作流就会在
图像预处理参考图上传.png
ComfyUI/
├─── output/
│         ├─── 图像预处理/


文件夹内得到预处理图像(我在工作流里只添加了三种预处理方案,小伙伴也可以尝试其它的预处理方案)


深度控制图
深度@控制生图示例@01.png
线条控制图
线条@控制生图示例@01.png
姿势控制图
姿势DITpose@控制生图示例@01.png
在打开FLUX文生图工作流
模型选择和基础文生图一样
停用FLUX生图节点组
控制生图停用节点.png
控制图上传
控制生图上传预处理图.png
在图像嵌入节点组中输入图像尺寸
控制生图图像嵌入.png
K采样器参数和文生图一样
如果对生图不满意就点击种子重新生图
文生图种子.png
如果我们用不同的模型就其它设置都保持相同就会得到完全不同风格的图像
flux1-dev-fp8-麦橘超然_v.1.0.safetensors出图效果
控制生图线条02.jpg

*************************************************************************
Qwen_Image模型生图

Qwen_Image模型的优缺点都很明显,而且我认为Qwen_Image的位置很尴尬,虽然它对提示词的理解对比FLUX有了明显的提升,但扩散模型在世界知识的学习上相较自回归模型有着先天缺陷,特别是在混元3.0开源后我们发现自回归模型在构图的精确性和对提示词的理解上对扩散模型的碾压优势。我个人觉得阿里应该不会继续扩散模型的路线,这意味着Qwen_Image官方将不会有新的迭代版本,去改善保守诟病的缺陷。这样一个20B参数的模型进行全局微调,对个人玩家来说成本太高,所以估计在Qwen_Image模型很长的时间都不会有改善。而且如果没有颠覆性的技术出现,我们将在不久的将来看到全系的扩散模型都将走入历史,包括wan系列的视频模型,flux,Qwen_Image系列的图像模型,都将是最后的绝唱!

Qwen_Image的构图能力比较强
  1. 一位年轻东亚女性芭蕾舞演员优雅地摆姿势。
  2. 她全身裸体露出小巧的乳房,和阴道。
  3. 她只穿着白色纯棉短袜。这位女士留着黑色头发,在脑后扎成一个整洁的发髻。
  4. 她的右腿笔直向上伸展,几乎垂直于地面,而左脚则放在地上支撑自己。
  5. 她的左手轻轻扶住抬起的腿部,右手向侧面伸出,手指微微弯曲。她面容平静,直视镜头。
  6. 背景非常简洁干净。光线柔和自然,投射出微妙的阴影,增强了图像的整体深度和立体感。
复制代码
Qwen_Image示例02.jpg
如果是FLUX用同样的提示词直接文生图出图就大概率会崩坏
FLUX生图对比.jpg
而且Qwen_Image有一定的中文编辑能力
  1. 一位皮肤白皙、长着黑色色长发的东亚年轻裸体女子坐在户外的水泥地面上,平静的直视镜头。
  2. 她的腹部用红色的水彩笔写着“肉便器”。她双手举着一张褶皱的纸,纸上用毛笔写着“上老王论坛当老王”。
  3. 她的胸部中等大小,乳头呈粉红色。她身材苗条,面容清秀。
  4. 背景是一面深色工业风格的墙壁。背景模糊。
复制代码

Qwen_Image示例01.jpg
Qwen_Image的控制出图能力也不错
  1. 一位年轻的东亚女性,她全身赤裸地跪在木质地板上,面容平静直视镜头。
  2. 她的皮肤白皙。
  3. 她的头发是黑色的,中等长度,自然垂落在肩膀和背部。
  4. 她的身体被粗实、天然纤维绳索紧紧捆绑在一起。这些绳子缠绕并固定了她的乳房,使其突出且可见。此外,还有一条绳索环绕着她的腰部,并向下延伸到大腿区域,将双腿绑在一起。
  5. 这种束缚方式强调了身体曲线,特别是胸部轮廓。
  6. 背景包括一个木制门框或柱子,背景模糊。
复制代码
参考图
Qwen_Image控制示例_参考图.png
深度预处理
深度@Qwen_Image控制示例_参考图@01.png
控制出图
Qwen_Image控制示例.jpg
Qwen_Image缺点也很明显,说直白点就是Qwen_Image出的图一眼看去就是美颜,磨皮,调色过渡的便宜货。
特别是人物特写的时候尤其明显。
我们可以通过使用其它模型对Qwen_Image的出图做低强度的重绘,比如wan2.2的低噪模型或者FLUX模型(wan2.2重绘强调不要超过0.25,FLUX重绘强度可以高点)。
wan2.2重绘
wan2.2细化.jpg
FLUX重绘
FLUX细化.jpg
工作流使用
按照路径下载保存好相应的模型
ComfyUI/
├─── models/
│      ├─── unet/
│      │      └───  Qwen_Image/
│      │               └─── qwen-image-Q8_0.gguf
│      ├─── text_encoders/
│      │      └───  Qwen_Image/
│      │               └─── qwen_2.5_vl_7b.safetensors
│      ├─── vae/
│      │      └───  Qwen_Image/
│      │               └─── qwen_image_vae.safetensors
│      ├─── upscale_models/
│      │      └─── 4xNomos8kSCHAT-S.safetensors
│      ├─── controlnet/
│      │      └───  Qwen_Image/
│      │               └─── Qwen-Image-InstantX-ControlNet-Union.safetensors
│      ├─── loras/
│      │      └───  Qwen_Image/
│      │               └───  加速/
│      │                        └─── Qwen-Image-Lightning-8steps-V2.0.safetensors

特别介绍下“virtual_vram_gb=虚拟显存容量”这个参数
如果你是小内存特别是在使用控制网生图的时候这个插件会有帮助
参数粗略可以如下计算
扩散模型容量-(你的显存X0.9-控制模型容量-采样降噪最少需要的显存)
假设你的显存是16G
使用的是扩散模型qwen-image-Q8_0.gguf大约20G
控制模型Qwen-Image-InstantX-ControlNet-Union.safetensors大约3G
1920X1080像素的图片采样降噪大约最少需要3G
最后算出来大概需要虚拟显存容量12G左右
也就是说把12G的扩散模型加载到内存中,只把8G加载到显存中
如果不使用控制生图,只是普通的文生图,那么就可以把9G的扩散模型加载到内存中,把11G加载到显存中

出图尺寸100-200万像素之间都可以
例如出图宽高比是9:16,那么720X1280到1080X1920都可以
Qwen_Image生图图像嵌入.png
wan2.2细化图(FLUX细化也是一样)
wan2.2细化图像加载.png

*************************************************************************
Qwen-Image-Edit编辑模型出图
模型选择
ComfyUI/
├─── models/
│      ├─── unet/
│      │      └───  Qwen_Image_Edit/
│      │               └─── Qwen-Image-Edit-2509-Q8_0.gguf
│      ├─── text_encoders/
│      │      └───  Qwen_Image/
│      │               └─── qwen_2.5_vl_7b.safetensors
│      ├─── vae/
│      │      └───  Qwen_Image/
│      │               └─── qwen_image_vae.safetensors
│      ├─── upscale_models/
│      │      └─── 4xNomos8kSCHAT-S.safetensors
│      ├─── controlnet/
│      │      └───  Qwen_Image/
│      │               └─── Qwen-Image-InstantX-ControlNet-Union.safetensors
│      ├─── loras/
│      │      └───  Qwen_Image_Edit/
│      │               └───  加速/
│      │                        └─── Qwen-Image-Edit-2509-Lightning-8steps-V1.0-fp32.safetensors
只是unet模型和加速Lora需要用Qwen-Image-Edit的,其它模型和Qwen-Image一样
模型上传.png
出图尺寸
Qwen-Image-Edit尽量出图控制在100万像素左右,不然效果不很好,如果觉的出图太小,后期可以用其它模型二次重绘。
出图尺寸.png
参考图上传
qwen_image_edit 支持3张参考图,根据需要上传
如果不需要三张,要把不需要的上传节点禁用
参考图上传.png
一张参考图
参考图
参考图01_01.jpg

Lora
1、真正的PS_V1.83K,强度0.8
2、性爱、裸体、其他有趣的东西,强度1.0
成人Lora可以和Qwen-Image通用
提示词
  1. 图1的女性和男人发生性关系的照片。
  2. 图1的女性坐在沙发上的男人身上,男人的阴茎插入她的阴道。
  3. 图1的女性看着镜头。
复制代码
一张参考图生图.jpg
一张参考图+控制图
参考图
参考图01_02.jpg
控制图
控制图03.png
提示词
  1. 图1的女性参考图2的姿势
复制代码
一张参考图 控制图_03.jpg
如果姿势和原图差别比较大,脸的角度比较大,那么人物一致性就会低些
控制图
控制图01.png

一张参考图 控制图_01.jpg
控制图
控制图02.png


一张参考图 控制图_02.jpg
二张参考图互动
参考图
参考图01_04.jpg
服装
服装01.jpg
服装
服装02.jpg


提示词
  1. 图1的女性穿上图3的服装
复制代码

换装参考图_01.jpg

换装参考图_02.jpg
也可以试试这种奇怪的玩法
参考图
参考图01_03.jpg
服装(把裸体作为服装
服装03.jpg
提示词
  1. 图1的女性穿上图3的服装
复制代码
换装参考图_03.jpg
不是每次都能成功,多换几个种子试试吧


还可以和道具图互动
狼牙棒
狼牙棒.jpg
提示词
  1. 图1的女性坐在沙发上,拿着图3的棒子插入自己的阴道
复制代码
狼牙棒01.jpg

狼牙棒02.jpg

狼牙棒04.jpg

狼牙棒03.jpg

三角木马(没找到图片,讲究着自己画了个怪怪的)
三角木马.jpg
提示词
  1. 图1的女性骑坐在图3的三角木架上
复制代码
三角木马互动.jpg


其它的玩法还可以看说明书

*************************************************************************
FLUX_kontext模型生图
工作流删了没必要的节点,更加简洁了,已更新到网盘了
FLUX_kontext模型图片对齐比较好,但是多图融合要比Qwen_Image_Edit
FLUX_kontext模型不像Qwen_Image_Edit内置了控制网,所以 FLUX_kontext控制要单独使用第三方的ControlNet模型,而其效果不理想。
所以我用只用FLUX_kontext做单图编辑

模型选择
注意“virtual_vram_gb=虚拟显存容量”这个参数一定要根据自己的显存修改
模型上传_1.jpeg
图像尺寸
图像尺寸_1.jpeg
修改背景
参考图
示例01_1.jpeg
提示词
  1. Change the background to pure black, keep the subject in the exact same position and pose
复制代码

修改背景对比_1.jpeg


修改背景_1.jpeg
移去服装(要使用RedCraft.safetensors)
参考图
示例02_1.jpeg
  1. Remove clothing
复制代码

移去服装对比_1.jpeg

移去服装_1.jpeg
移去水印
参考图
示例03_1.jpeg
  1. Remove the watermark from the picture
复制代码
移去水印对比_1.jpeg


移去水印_1.jpeg

可以看的出FLUX_kontext编辑更像PS主体就好像完全剪切下来的,基本没有任何变化,这有好处也有坏处。
FLUX_kontex模型的Lora也很多,可以提供很多稀奇古怪的功能,可以去C站找。如果你想学习Lora训练,强烈建议你从训练FLUX_kontex的Lora开始,会很有趣。
*************************************************************************
本地大语言模型部署和调用
所需要的软件我都放在网盘“本地大语言模型部署和调用”文件夹中)
很多小伙伴都为文生图和文生视频的提示词感到困扰,我们完全可以通过大语言模型来帮我们生成提示词。

模型API调用客户端
你可以把它看成一个UI,提供可视化的方式完成大语言模型对话。
推荐一款开源ai调用客户端Cherry Studio,国人开发全中文界面,对萌新小伙伴非常友好,功能也非常强调,自持mcp服务调用。
萌新小伙伴可以使用便携伴,不用安装,删除也方便。
如果我们平时工作,学习就可以直接调用各大厂商的api
比如我们要用阿里的模型
Cherry Studio界面.png

Cherry Studio阿里API.png
但是我们要生成成人内容,比如成人提示词和小说的润色扩写等等,那官方api就不行了,所以我们就需要本地部署开源的经过微调的大模型
推荐两个适合个人使用的本地大模型服务部署框架,llama.cpp和ollama
这两个框架其实师出同源,GGUF格式就是llama.cpp研发的特别适合消费级计算机硬件。

我们就用这两款框架分别部署qwen3qwen3 vl(视觉模型,用于图片内容反推)给大家做个示范。

用ollama部署qwen3大语言模型
ollama官网没有被墙,而且拉取模型速度非常快,所以模型我就没有搬运
安装完ollama软件后我们需要修改一下模型存放位置,因为ollama拉取的模型会默认存储在C盘
所以我们要新建环境变量来修改模型存储位置,和服务监听端口

在 Windows 搜索栏中输入并打开 “编辑系统环境变量”。
点击 “环境变量” 按钮。

在 “用户变量”下,点击 “新建”,
输入 变量名“OLLAMA_MODELS”和 变量值“D:\Ollama_models
OLLAMA_MODELS.png
输入 变量名“OLLAMA_HOST”和 变量值“0.0.0.0:11434
OLLAMA_HOST.png
新建环境变量后,我们要重启Ollama
在屏幕又下角找到ollama图标点击退出就可以了
退出.png
打开ollama官网,搜索qwen3-abliterated,找到相关模型,我推荐huihui_ai发布的模型
ollama模型搜索01.png

ollama模型搜索03.png

ollama模型搜索02.png

打开CMD 输入刚才复制的命令
8b模型
  1. ollama run huihui_ai/qwen3-abliterated:8b
复制代码

16b模型
  1. ollama run huihui_ai/qwen3-abliterated:16b
复制代码

32b模型
  1. ollama run huihui_ai/qwen3-abliterated:32b
复制代码


模型下载命令.png


模型下载速度.png

速度挺快的
如果下到快结束的时候 速度下降,“ctrl+c” 中断,然后重新输入命令,支持断点续传。
模型下载完成后会自动运行就可以对话了,但在CMD里面对话不方便也不美观,所以我们要用Cherry Studio等客户端调用。

模型下载完成.png
关闭CMD窗口,并在屏幕又下角找到ollama图标点击退出
重新打开CMD
输入命令,启动ollama serve

  1. ollama serve
复制代码

然后打开Cherry Studio客户端
在设置中找到ollama
完成ollama api 的设置
Cherry Studio_ollama_API.png

Cherry Studio_ollama_API02.png
Cherry Studio完成设置返回.png
然后再创建文生图助手

文生图助手选择模型01.png

文生图助手选择模型02.png

文生图助手设置01.png

文生图助手设置02.png

好了都完成了 我们就可以润色提示词了
输入


  1. 一个裸体女性在跳舞
复制代码
润色后的提示词
  1. A young, athletic woman with sun-kissed skin, long raven-black hair flowing in rhythmic waves, and piercing amber eyes brimming with joyful abandon, dances barefoot in a mist-laden forest clearing at dawn. Her supple, unadorned body is crowned with a crown of wildflowers and intertwined with gossamer vines, their tips glistening with dew that catches the golden light filtering through towering pines above. Behind her, a cascading waterfall tumbles down mossy boulders, its mist giving rise to a spectral rainbow arching across the scene; the water’s sparkle mirrors the faint, ethereal glow radiating from her upraised palms, hinting at an unseen magical force awakening with her motion. The atmosphere blends primal freedom and mystical reverence, captured in a dynamic, low-angle shot that emphasizes her fluid, almost weightless movements and the intricate textures of her environment, rendered in a photorealist style infused with fantasy-inspired luminescence and soft, golden-hour pastel hues.

  2. 一位年轻健美的女子,肌肤沐浴着阳光的暖意,乌黑长发如波浪般有节奏地飘动,琥珀色的眼眸锐利而充满无拘无束的欢愉。她在黎明时分薄雾缭绕的林间空地上赤足起舞,柔韧的身体未加任何修饰,头戴野花编织的花冠,缠绕着蛛丝般纤细的藤蔓,藤尖挂着晶莹露珠,捕捉着从高耸松林间滤下的金色光芒。她身后,瀑布奔泻而下,冲刷着长满青苔的巨石,水雾升腾形成一道横跨景色的幽灵般彩虹;水面的闪烁与她高举手掌散发出的缥缈微光交相辉映,暗示着随她动作苏醒的隐秘魔力。整个场景融合了原始的自由与神秘的崇敬,通过动态低角度镜头捕捉,突显她流畅近乎失重的舞姿与环境中错综复杂的质感,以写实主义风格呈现,并融入奇幻灵感的辉光及柔和的金色时刻粉彩色调。
复制代码
*************************************************************************
用llama.cpp来部署qwen3-vl
llama.cpp 更新非常频繁,有的时候几个小时就发布一个新版本。
但部署却非常简单,就是模型要去huggingface下载。我已经传到网盘了
我就用这个qwen3-vl专用版来示范下
解压后,在llama-qwen3-vl-3-win-cuda-12.8-x64文件夹下进入CMD
llama启动CMD.png

然后输入命令

  1. llama-server.exe ^
  2.     --model D:\llama\Qwen3-VL-30B-A3B-NSFW\Qwen3-VL-30B-A3B-NSFW-q8_0.gguf ^
  3.     --mmproj D:\llama\Qwen3-VL-30B-A3B-NSFW\Qwen3-VL-30B-A3B-NSFW-mmproj-f16.gguf ^
  4.     --host 0.0.0.0 ^
  5.     --port 8000 ^
  6.     --n_gpu_layers 0
复制代码

--model: 指定要加载的模型文件路径。

--mmproj: 指定多模态投影文件(用于视觉功能)的路径。(因为qwen3 vl 需要读取图片,所以需要。语言模型就不需要)

--host 0.0.0.0: 将服务器绑定到所有可用网络接口,使其可以从外部访问。

--port 8000: 指定服务器监听的端口号。

--n_gpu_layers 0: 类似我经常说的virtual_vram_gb这个参数,把部分模型加载到内存中,比如Qwen3-VL-30B-A3B-NSFW-q8_0这模型有30G左右,这模型有48层,那么大概每层大概0.625G。
如果你是12G显卡,那么扣除运行模型所需的4G,还有8g可以装模型,那么大概装12层模型,就填12。我这里填的0是显存消耗最小,把所有模型都加载到内存上了,速度也是最慢的

启动成功了
llama启动成功.png


然后还是打开Cherry Studio 在设置没有llama.cpp的供应商模版
所以要自己添加
Cherry Studio新建llama服务供应商01.png

Cherry Studio新建llama服务供应商02.png

Cherry Studio设置llama模型01.png

Cherry Studio设置llama模型02.png

好了模型设置好了
和刚才一样添加个图片反推助手
图片反推助手01.png

图片反推助手02.png

好了 可以上传图片了
图片反推上传图片.png


图片反推助示例.png



  1. 这是一张描绘女性的图片,其风格为绳缚(Shibari)艺术。

  2. 图中,一位年轻女性以跪姿被绳索捆绑。她的身体上覆盖着一层油亮的光泽,使其皮肤看起来湿润而富有质感。她的双手被绳子反绑在背后,身体微微前倾。

  3. 她的身体被多股棕褐色的粗绳紧密地缠绕着。绳子从她的双臂上方穿过,交叉捆住上半身,将她的胸部和腹部牢牢固定。她的头发是棕色的,带有刘海。

  4. 整体背景简洁,为深色,突出了人物和她被捆绑的身体。图片的左上角有白色的艺术字体水印。

复制代码

*************************************************************************
综合示例
每个小伙伴都有自己的性癖,有些比较特殊的体型画面构图,和人物姿势,光靠提示词表达,模型不能很好的理解,所以我们可以借助可以捏人的H游戏,诸如Virt A Mate,DAZ Studio,甜心选择2,恋活2,等都是不错的选择。
用这些游戏的捏人和场景布设的功能,制作出示意图然后,用模型的控制生图,来制作一些自己喜欢的图像作品。
比如巨乳
巨乳模型.jpg
Virt A Mate乳房形状的滑块有很多,觉的形状不自然的可以自己调整形状。
Virt A Mate用的人体模型就是DAZ Studio的G2模型,如果喜欢更自然点的可以玩下DAZ Studio的G8模型。
我个人喜欢骨感型的就不去捏乳房了。
用细条预处理(可以根据自己的需要灵活选择预处理的方式)
线条@巨乳@01.jpg
Qwen_Image_控制文生图
巨乳qwen_image.jpg
明显皮肤细节和肌肉线条过于简单,画面过于干净。我们在用wan2.2低噪模型进行细化
wan2.2巨乳.jpg


巨乳特写.jpg
我比较喜欢骨感
骨感03.jpg
我们还可以使用Qwen_Image_Edit对图片进行编辑
骨感02.jpg

骨感04.jpg

骨感05.jpg

骨感06.jpg

我们可以灵活使用各种模型和其它的工具充分发挥各模型的优点现阶段还没有能解决所有问题的模型或者工作流
而其各种参数如降噪强度,采样步数,采样器,调度器的选择都不是一成不变的,可以更具需要进行调整。这也是玩AI的乐趣之一。

*************************************************************************z_image_turbo模型生图(11.27更新)
阿里11.27开源的人物照片特化模型,只有6B的参数,但在人物照片方面的表现非常优异,而且训练非常大胆,明星照片和成人内容都没有脱敏,所以在成人内容生成方面表现优异,能在不使用Lora的情况下生成很多成人内容
随着开源社区的后续支持,期待后续会有更好的表现。
ComfyUI/
├─── models/
│      ├─── unet/
│      │      └───  z_image_turbo/
│      │               └─── z_image_turbo_bf16.safetensors
│      ├─── text_encoders/
│      │      └───  z_image_turbo/
│      │               └─── qwen_3_4b.safetensors
│      ├─── vae/
│      │      └───  FLUX/
│      │               └─── vae_FULX.safetensors
vae模型和FLUX的vae模型相同
注意根据自己显存大小调整虚拟显存
z_image_turbo模型加载.jpg
生成图像尺寸200万像素表现不错
z_image_turbo尺寸.jpg
生图示例
简单的提示词
提示词
  1. 刘亦菲
复制代码
文生图构图_00014_.jpg



提示词
  1. 迪丽热巴
复制代码
文生图构图_00016_.jpg



提示词
  1. 刘亦菲全身裸体
复制代码
文生图构图_00018_.jpg



提示词
  1. 迪丽热巴全身裸体
复制代码
文生图构图_00017_.jpg



对复杂提示词也有不错的表现
提示词
  1. **姿态、动作**:  
  2. 角色呈跪姿,臀部高高翘起,身体被棕色绳索呈交叉状捆绑,双臂自然摆放,左手轻触臀部,头部微微后仰,面部表情略显惊讶(张嘴、睁大眼睛),整体姿态展现出被束缚的动态感。  

  3. **发型、妆容**:  
  4. 头发为浅蓝色短发,发梢微卷且蓬松,妆容精致,蓝紫色大眼睛明亮有神,眼妆带有高光,脸颊晕染着自然的粉色腮红,

  5. **服装、饰品**:  
  6. 仅穿着一条深蓝色内裤(腰带处有金属扣装饰),颈部系着同色系深蓝色领带作为装饰;身体被多根棕色绳索交叉捆绑,绳索在身体上形成规则的缠绕图案,同时可见黑色绑带装饰于腿部,整体服饰以裸露为主,通过绳索和配饰点缀。脚穿白色短棉袜。  

  7. **场景环境**:  
  8. 背景为简约的室内场景,浅灰色墙面作为底色,整体环境简洁,突出人物主体,营造出私密的氛围。  

  9. **风格,光影**:  
  10. 高清摄影写真;光影处理柔和且富有层次感,通过明暗对比凸显身体曲线(如乳房、臀部的凹凸感),暖色调的光线聚焦于角色皮肤,增强肌肤的质感与立体感,营造出细腻温馨的视觉效果。
复制代码
文生图构图_00034_.jpg

*************************************************************************

FLUX2模型生图(12.04更新)
FLUX2模型拥有32B参数,具备丰富的世界知识,除了生图以为还拥有类似FLUX_kontext模型的图像编辑能力。
但硬件要求比较高,采样速度慢。并且在数据集的成人内容审查方面比较严格,在生成成人内容方面还需要开源社区的支持。
FLUX2模型和z_image正好形成高低搭配互补。
模型目录结构树
ComfyUI/
├─── models/
│      ├─── unet/
│      │      └───  FLUX2/
│      │               ├─── flux2_dev_fp8.safetensors
│      │               └─── flux2-dev-Q8_0.gguf(gguf格式、safetensors格式根据自己喜欢下载一个就可以了)
│      ├─── text_encoders/
│      │      └───  FLUX2/
│      │               └─── mistral_3_small_flux2_fp8.safetensors
│      ├─── vae/
│      │      └───  FLUX2/
│      │               └─── flux2-vae.safetensors
模型加载
FLUX2模型加载.jpg
flux2_dev_fp8.safetensors模型速度要快一些,也是comfyui官方推荐的格式。
flux2-dev-Q8_0.gguf理论上生成质量更接近BF16,但我测试下来感觉不明显,有兴趣的小伙伴可以自己测试下。
参考图上传
参考图上传01.jpg


参考图上传02.jpg
flux2_dev可以支持更多的参考图,但是我个人推荐参考图不要超过2张,因为每增加一张参考图都会增加采样时间。而其参考图像素也不要超过100万像素
图像尺寸
图像尺寸.jpg
200万像素左右比较合适,但是姿势参考时最好设置100万像素,尺寸大了容易动作容易变形。
基础文生图
提示词
  1. 一位年轻的东亚女性的面部特写。
  2. 她的面容柔和而精致,深褐色眼眸。
  3. 柔和光从一侧洒落,在她脸上投下细腻的光影,突出了颧骨的柔和曲线和下颌的线条。
  4. 她的肌肤细节纹理精致。
  5. 每个毛孔、每根睫毛以及她嘴唇的细微纹理都清晰可见。
  6. 几缕黑色丝滑的发丝拂过她的前额。
  7. 色调温暖而浓郁,以金色和琥珀色为主。
复制代码
示例图
文生图01.jpg
可以看的无论细节光影出相较FLUX和Qwen_Image都有了提升,但和特化的人物肖像模型z_image相比孰优孰劣,就看各位小伙伴的喜好了。
FLUX2的强项其实是丰富的世界知识,但这些在成人内容生成方面帮助不大,这里就不展开了
成人内容文生图
提示词
  1. 年轻的东亚女性的写实摄影作品
  2. **姿态、动作**:角色呈站立姿态,身体直立,双臂自然垂放于身体两侧,双腿分开,保持静态静止状态。  
  3. **发型、妆容**:发型为垂至腰部的银白色长直发,发丝柔顺且带有层次感;妆容精致,细腻眼妆,唇色为淡粉色,整体风格清新柔美。  
  4. **服装、饰品**:角色主体裸露,肌肤上布满日文及英文文字(如大腿处的“fuck me”等);下着浅灰色过膝长袜,袜口处装饰有白色蕾丝边及粉色细节,腿部有粉色装饰带,整体搭配凸显简约与个性。  
  5. **场景环境**:背景为纯黑色,无其他物体或装饰,使角色成为视觉焦点。  
  6. **风格,光影**:光影采用正面主光源,均匀照亮角色,营造出柔和的明暗层次。
复制代码
示例图
成人文生图01.jpg


成人文生图02.jpg
可以看的出FLUX2在成人内容审查方面是比较严格,后续要看开源社区的支持了,但是32B的参数在Lora训练硬件上是不小的挑战。
消费娱乐级显卡中估计也只有4090魔改的48G显存可以勉强一试了。
图像编辑
客观的说FLUX2的图像编辑功能是要优于FLUX_kontext和Qwen-Image-Edit-2509的,特别是在多图编辑和融合方面。
图像的纹理细节保持的都不错,人物一致性不能说完美但也优于其它开源模型。
单图编辑
参考图1
图像编辑_原图01.jpg
提示词
  1. 移除图1的女性的白色头巾,修改发型为黑色长直发
复制代码
示例图
图像编辑_示例01.jpg
参考图1
图像编辑_原图02.jpg
提示词
  1. 移除图1女性的黑色短袖和裙子
复制代码
示例图
图像编辑_示例02.jpg
FLUX2数据集审查还严格的没有乳头和性器官
风格转绘
参考图1
风格转绘_参考图.jpg
提示词
  1. convert the picture to Ghibli Style
复制代码
示例图
风格转绘_示例.jpg
基本上其它模型有的风格FLUX2都有,提示词可以参考我在FLUX_kontext工作流里的注释
人物姿势编辑
参考图1
姿势修改_人物.jpg
参考图2
姿势修改_姿势01.jpg
提示词
  1. 图1中的女性采用了图像2的姿势。保持图1中的女性服装、体型和面部特征不变
复制代码
示例图
姿势修改_示例01.jpg
参考图2
姿势修改_姿势02.jpg
提示词
  1. 图1中的女性采用了图像2的姿势。保持图1中的女性服装、体型和面部特征不变
复制代码
示例图
姿势修改_示例02.jpg
人物换装
参考图1
服装试穿_人物.jpg
参考图2
服装试穿_服装01.jpg
提示词
  1. 图1的女性换上图2的服装
复制代码
示例图
服装试穿_示例01.jpg
参考图2
服装试穿_服装02.jpg
提示词
  1. 图1的女性换上图2的服装
复制代码
示例图
服装试穿_示例02.jpg
换装个人感觉FLUX2换装是所有开源模型最优秀的
面部迁移
我在C在上看到一位老哥特别喜欢训练面部迁移Lora,我们就测试下她的Lora
参考图1
面部迁移_参考图01.jpg
参考图2
面部迁移_参考图02.jpg
提示词
  1. {
  2.     "task": "head_swap",
  3.     "base_image": {
  4.         "source": "Image 1",
  5.         "preserve": [
  6.             "complete_body",
  7.             "lighting",
  8.             "environment",
  9.             "background",
  10.             "clothing",
  11.             "scene_context"
  12.         ],
  13.         "extract_expression_and_angle": [
  14.             "current_facial_expression",
  15.             "current_head_pose",
  16.             "current_head_angle"
  17.         ]
  18.     },
  19.     "replacement": {
  20.         "source": "Image 2",
  21.         "extract": "complete_head_identity",
  22.         "must_preserve_from_image2": [
  23.             "all_facial_features",
  24.             "face_shape_and_structure",
  25.             "complete_hair",
  26.             "skin_characteristics",
  27.             "personal_identity"
  28.         ],
  29.         "apply_from_image1": [
  30.             "match_expression",
  31.             "match_head_angle"
  32.         ]
  33.     },
  34.     "blending_requirements": {
  35.         "identity_preservation": {
  36.             "priority": "critical",
  37.             "instruction": "maintain complete identity from Image 2 including all facial features and characteristics"
  38.         },
  39.         "expression_matching": {
  40.             "priority": "high",
  41.             "instruction": "reproduce the facial expression from Image 1 on the face from Image 2"
  42.         },
  43.         "angle_matching": {
  44.             "priority": "high",
  45.             "instruction": "position head from Image 2 at same angle as Image 1"
  46.         },
  47.         "seamless_integration": {
  48.             "lighting_match": "adaptive",
  49.             "shadow_consistency": "automatic",
  50.             "edge_blending": "smooth",
  51.             "color_matching": "natural"
  52.         }
  53.     },
  54.     "output": {
  55.         "description": "head from Image 2 seamlessly integrated onto body from Image 1, matching the original expression and head angle",
  56.         "maintain_realism": "photorealistic_quality"
  57.     }
  58. }
复制代码
作者给的提示词是JSON结构,不用管直接复制就行了
示例图
面部迁移_示例.jpg
和Qwen-Image-Edit-2509相比如何,小伙伴们自行评价吧,但作者说这只是测试版,以后估计还会继续训练。
人物和物品互动
参考图1
人物物品互动_参考图01.jpg
参考图2
人物物品互动_参考图02.jpg
提示词
  1. 图1的女性拿着图2的道具放在嘴边吮吸
复制代码
示例图
人物物品互动_示例.jpg
多图融合
参考图1
多图融合_参考图01.jpg
参考图2
多图融合_参考图02.jpg
参考图3
多图融合_参考图03.jpg
提示词
  1. 图1的女性和图2的女性并排坐在图3的沙发上
复制代码
示例图
多图融合_示例.jpg
可以看的出人物服装保持的很不错,但人物面部的一致性还是不够好还要用其它面部迁移的工作流进行修复
注意了使用参考图越多,采样速度越慢,不知道以后Comfyui官方会不会进行优化。

我这里只是抛砖引玉,其它的玩法小伙伴还可以自行开发。
*************************************************************************
局部重绘
局部重绘的范围很广,重绘手脚乳头性器官,和面部重绘面部迁移服装迁移布景物品的增减扩图等 都是局部重绘的范畴。


wan2.2模型的手部重绘
面部和手部结构相对复杂,特别是在绘制全身远景图时,应为像素过小模型分配的注意力不够,往往会出现结构崩坏的情况,所以手部和面部的重绘是我们会经常用到。


模型加载
wan2.2模型的人体结构比较好,所以用来修手比较好,flux模型则可以用来修脸、乳头和阴道。
wan2.2模型加载.jpg
提示词
简单点就可以了
  1. 完美纤细的手
复制代码

重要的参数
自动局部重绘重要参数.jpg
bbox剪裁系数
2.0剪裁系数
2倍BBOX.jpg
4.0剪裁系数
4倍BBOX.jpg
我们可以看到2.0剪裁系数,bbox占的区域比例较大,这就可以给模型重绘提供更多的注意力重绘的会更加准确
4.0剪裁系数,虽然重绘的区域注意力少了,但是重绘区域外的注意力相应增加,可以提高重绘的内容和整体的融合程度
wan2.2的能力很强只要很小的注意力就能画出不错的手,所以剪裁系数可以给的大点,以获得更好的整体的融合程度。


最大尺寸
就是将裁剪的图像的最大边,缩放到这一尺寸
如这张图的左右手在最终降噪的时候使用的是以下尺寸
(387, 693) x 1.8470818996429443 -> (714, 1280)
(360, 756) x 1.6931853294372559 -> (609, 1280)
会影响出图速度


sam膨胀
就是在sam生成的遮罩基础上进行扩张


降噪
重绘的幅度,没有固定的值,可以根据实际情况多次尝试,我一般wan2.2模型降噪会在0.3左右调整,FLUX会在0.5左右调整。

修复前

手局部生成样图.jpg

手局部修改前.jpg

修复后
手局部修改后.jpg
误区
很多小伙可能会以为,局部重绘的过程不是有把图片裁切放大的步骤,那么局部重绘后图像面部或手部不是会变的更加清晰吗?
局部重绘是为了让模型重绘结构错误,或者需要调整的区域,而不是提升区域的清晰度
我们以后会提到图像放大的方法如SD,TTP等,扩散模型都不是启的放大作用,而是对经过放大模型处理过的图像,进行重绘。

*************************************************************************
FLUX模型的阴道重绘


模型加载
flux模型加载.jpg
Lora不仅可以用于局部重绘,也可以用于FLUX文生图


手动遮罩
因为没有模型检测阴部和乳头,所以只能手动遮罩
手动遮罩01.jpg

手动遮罩02.jpg


提示词
作者给的,有条件的小伙伴可以去C站给作者点个赞
修复阴道
  1. bush pussy
  2. 灌木阴户 - 顶部留有毛发

  3. butterfly pussy
  4. 蝴蝶阴户 - 具有厚实阴唇的阴户

  5. hairy pussy
  6. 多毛阴户 - 长有毛发的阴户

  7. shaved pussy
  8. 剃毛阴户 - 采用骆驼趾(内嵌式)造型的剃毛阴户

  9. asian pussy
  10. 亚洲女性私处 - 白皮肤女性深色阴唇的阴道

  11. pink pussy
  12. 粉嫩私处 - 粉红色娇嫩阴道
复制代码
修复乳头
  1. big areolas
  2. 大乳晕-中到大圆形乳晕

  3. dark nipples
  4. 深色乳头-深色乳头与自然皮肤的对比更明显

  5. ghost nipples
  6. 幽灵乳头-乳头颜色略显苍白

  7. long nipples
  8. 长乳头-可以轻松咬到的乳头

  9. puffy nipples
  10. 乳头肿胀-乳房较小,但乳头顶端覆盖着致密的乳头

  11. saggy breasts
  12. 乳房下垂——由于重力作用,乳房有点下垂

  13. small areolas
  14. 小乳晕-乳晕半径较小

  15. veiny areolas
  16. 乳晕静脉-皮肤下出现的静脉
复制代码
重要的参数
手动局部参数.jpg
修复前
阴道修复原图.jpg


阴道修复前.jpg
修复后
阴道修复原图修复后.jpg

阴道修复后.jpg
还是有明显的改善了,其实阴道,和阴茎在外形上算是人体比较复杂的器官了
*************************************************************************
面部迁移
面部迁移在comfyui实现现在流行的有2种技术路径,
用Qwen_Image_Edit或FLUX_kontext等图像编辑模型,在潜空间对图像编辑,然后在根据提示词扩散降噪。
这种方法脸部素材和需要被替换的脸部,关键点越匹配,那么根据提示词扩散降噪的编辑程度就会越低
那么一致性就会越强,但是光照、肤色、阴影、头部姿态以及边缘融合却会越差
反之关键点相差越远,一致性就会变差,但光照、肤色、阴影、头部姿态以及边缘融合反而会变强
另一种就是用ipadapter和pulid等方式根据一张参考图捕捉面部特征,微调模型。这类技术路径泛化性强。比起Lora训练方便。
但因为只根据一张图微调模型,所以如果面部角度相差过大,一致性保持就会变差

Qwen_Image_Edit2509面部迁移
模型
Qwen_Image_Edit模型.jpg
和Qwen_Image_Edit2509生图使用的模型完全一样
需重绘脸部
需重绘脸部图像.jpg
面部素材
面部素材.jpg
上传图片手动编辑遮罩
尽量把整个头都遮罩起来
Qwen_Image_Edit上传图像.jpg

Qwen_Image_Edit编辑遮罩.jpg
执行图像预处理节点组
Qwen_Image_Edit素材预处理.jpg
对上传的图片进行预处理,目的是让素材脸和需要修改的脸的大小,位置尽可能的对齐
如果熟悉PS等图像处理软件,完全可以用其它工具进行类似的图像预处理
处理后面部素材
素材预处理.jpg
处理后需重绘脸部
需重绘预处理.jpg
面部重绘后
Qwen_Image_Edit.jpg
*************************************************************************
instantID面部迁移
模型
ComfyUI/
├───models/
│      ├───checkpoints/
│      │      └───sdxl/
│      │              └─── juggernautXL_ragnarokBy.safetensors
│      ├───ipadapter/
│      │      └─── ip-adapter-plus-face_sdxl_vit-h.safetensors
│      ├───instantid/
│      │      └─── InstantID.bin
│      ├───controlnet/
│      │      └───InstantID/
│      │              └─── InstantID.safetensors
│      ├───insightface/
│      │      └───models/
│      │              ├───antelopev2/
│      │              │      ├─── 1k3d68.onnx
│      │              │      ├─── 2d106det.onnx
│      │              │      ├─── genderage.onnx
│      │              │      ├─── glintr100.onnx
│      │              │      └─── scrfd_10g_bnkps.onnx
│      │              └───buffalo_l/
│      │                      ├─── 1k3d68.onnx
│      │                      ├─── 2d106det.onnx
│      │                      ├─── det_10g.onnx
│      │                      ├─── genderage.onnx
│      │                      └─── w600k_r50.onnx
│      ├───clip_vision/
│      │      └─── SDXL风格视觉(CLIP-ViT-H-14-laion2B-s32B-b79K).safetensors
│      ├───RMBG/
│      │      └───body_segment
│      │              └─── deeplabv3p-resnet50-human.onnx
instantID模型.jpg
模型比较多,要仔细检查
instantID面部素材预处理
instantID面部素材.jpg
如果素材和需重绘脸部色彩,亮度相差较大,可以简单的调色。
“不透明度”设置为0,则不调色。
instantID需重绘面部预处理
instantID需重绘面部.jpg
重要参数
InstantID参数.jpg
参数可以根据实际情况反复调整,以得到最好的效果
面部重绘后
instantID.jpg
*************************************************************************
pulid面部迁移
模型
ComfyUI/
├───models/
│      ├───unet/
│      │      └───FLUX/
│      │              └─── flux1-dev-Q8_0.gguf
│      ├───vae/
│      │      └───FLUX/
│      │              └─── vae_FULX.safetensors
│      ├───text_encoders/
│      │      └───FLUX/
│      │              ├─── clip_l.safetensors
│      │              └─── t5xxl_fp16.safetensors
│      ├───controlnet/
│      │      └───FLUX/
│      │              └─── FLUX.1-dev-ControlNet-Union-Pro-2.0-fp8.safetensors
│      ├───insightface/
│      │      └───models/
│      │              ├───antelopev2/
│      │              │      ├─── 1k3d68.onnx
│      │              │      ├─── 2d106det.onnx
│      │              │      ├─── genderage.onnx
│      │              │      ├─── glintr100.onnx
│      │              │      └─── scrfd_10g_bnkps.onnx
│      │              └───buffalo_l/
│      │                      ├─── 1k3d68.onnx
│      │                      ├─── 2d106det.onnx
│      │                      ├─── det_10g.onnx
│      │                      ├─── genderage.onnx
│      │                      └─── w600k_r50.onnx
│      ├───pulid/
│      │      └─── pulid_flux_v0.9.1.safetensors
│      ├───RMBG/
│      │      └───body_segment
│      │              └─── deeplabv3p-resnet50-human.onnx
│      ├───facexlib/
│      │      ├─── detection_Resnet50_Final.pth
│      │      ├─── parsing_bisenet.pth
│      │      └─── parsing_parsenet.pth
│      ├───clip/
│      │      └─── EVA02_CLIP_L_336_psz14_s6B.pt
pulid模型.jpg
面部素材预处理、需重绘面部预处理和instantID设置完全一样
面部重绘后
PULID.jpg
*************************************************************************
内补条件生图(2026.01.01更新)
小伙伴们好久不见,最近年底工作有点忙,所以很久没有更新了,元旦放假正好宅在家里,祝小伙伴们元旦快乐。
正好前几天阿里更新了qwen-image-edit-2511编辑模型,我们就结合qwen-image-edit-2511模型,给大家举几个内补条件生图的例子。
其实我们以前的局部重绘就是内补条件的一种表现形式,但借助了一些第三方的节点。这次我们就用comfyui原生的内补模型条件节点来实现。
模型目录结构
├───models/
│      ├───unet/
│      │      └───Qwen_Image_Edit/
│      │              └───qwen-image-edit-2511-Q8_0.gguf
│      ├───text_encoders/
│      │      └───Qwen_Image/
│      │              └───qwen_2.5_vl_7b.safetensors
│      ├───vae/
│      │      └───Qwen_Image/
│      │              └───qwen_image_vae.safetensors
│      ├───loras/
│      │      └───Qwen_Image_Edit/
│      │              └───加速/
│      │                      └───Qwen-Image-Edit-2511-Lightning-4steps-V1.0-fp32.safetensors


模型加载
comfyui新更新的子图模式很好用,有空的话我会把有用的工作流都重新改一下,把复杂的节点都封装到子图里,这样看起来会简单点。
模型加载.jpg
模型选择
模型选择.jpg
一定要选对模型,我看到的小伙伴的报错信息绝大部分都是没有找到模型而造成的。
示例
标准图1.jpg
我们只想移除这张图中女孩的裙子,如果我们直接用以前的方法,我们可能会将上衣和裙子一起移除,所以我们就需要遮罩裙子区域
遮罩01.jpg


遮罩02.jpg
遮罩范围可以大一些,如果需要还可以在遮罩边缘加点羽化。
模式选择
模式选择.png
提示词
  1. 移除图1女性的服装,全身裸体
复制代码

提示词.jpg
出图效果
出图效果.jpg
我们再来试试面部重绘,正好我们测试一下C站上一位老哥的换头Lora
上传图片
上传图片.jpg
遮罩头部
用同样的办法给需要重绘的区域添加遮罩
头部遮罩.jpg
Lora选择
Lora选择.jpg
提示词

作者给的,直接复制就可以
  1. head_swap: start with Picture 1 as the base image, keeping its lighting, environment, and background. remove the head from Picture 1 completely and replace it with the head from Picture 2. ensure the head and body have correct anatomical proportions, and blend the skin tones, shadows, and lighting naturally so the final result appears as one coherent, realistic person.
复制代码


换脸提示词.jpg
出图效果
换脸效果展示.jpg
虽然Lora是在2509上训练的,但在2511上的表现也还不错
内补条件生图用起来很简单,但是用处还是挺多的,小伙伴们可以自己研究一些新的玩法,我这里只是抛砖引玉
顺便说下qwen-image-edit-2511在角色一致性等方面还是有不少提升的,用来制作套图效果很不错,方法和qwen-image-edit一模一样
示例图1
示例01.jpg
示例图2
示例02.jpg
示例图3
示例03.jpg
示例图4
示例04.jpg
示例图5
示例05.jpg
示例图6
示例06.jpg
*************************************************************************
Qwen_Image_Edit进阶工作流(2026.03.07更新)
开年了,又要开始辛苦搬砖了,年初不忙继续更新帖子。
看到有小伙伴留言说想玩一下Qwen-Rapid-AIO-NSFW这类的模型。
Qwen-Rapid-AIO-NSFW其实一个融合模型,就是将各种成人Lora调整了权重,然后和CLIP、VAE模型打包在了一起。并不是什么新模型。
对萌新小伙伴来说用起来要简单些不需要额外添加LORA,就能生成NSFW内容。但也有缺点就是和其它Lora兼容性比较差
该模型已经更新迭代了23个版本了,感兴趣的小伙伴可以到huggingface上查看版本说明。
个人感觉V20版本比较好用,就只上传了V20版本到网盘,小伙伴们也可以尝试其它版本。
顺便更新了一下Qwen_Image_Edit的工作流,在官方模版的基础上整合了一些其它的节点,重新比较完整的介绍一下Qwen_Image_Edit模型的功能。
希望能给小伙伴们一点启发。


注意:
Qwen-Rapid-AIO-NSFW要放在models/checkpoints文件夹内,和其它unet模型存放在models/unet文件夹内,
虽然Qwen-Rapid-AIO-NSFW模型打包了CLIP、VAE模型,但我们还是用qwen的方便些。


模型加载:
模型加载.jpg


Lora加载.jpg
注意:
如果用Qwen-Rapid-AIO-NSFW模型就不要使用其他Lora,包括加速Lora
如果使用了原版模型或其它微调模型就要启用加速Lora
推荐使用Qwen-Image-Lightning-8steps-V2.0-fp32.safetensors,也可以尝试Qwen-Image-Edit-2511-Lightning-8steps-V1.0-fp32.safetensors
但我个人感觉Qwen-Image的加速Lora效果反而好一些。


参考图加载:

参考图加载.jpg
注意:
Qwen_Image_Edit的生图尺寸100-200万像素比较合适。
需要几张参考图就开启几个图像节点,要注意把不需要的图像加载节点框选用Ctrl+B忽略掉


生图尺寸:
出图尺寸.jpg
注意:
Qwen_Image_Edit的生图尺寸100-200万像素比较合适。
100万像素往往会有更好的效果。


提示词:
提示词模式选择.jpg
注意:
Qwen_Image_Edit有2个大版本2509,2511。所有微调模型和融合模型都是基于这两个基础模型衍生出的。
比如Qwen-Rapid-AIO-NSFW-V20就是基于2511版本的,而动漫转真实.safetensors这款微调模型是基于2509版本的。
要根据模型的大版本选择。


采样:
采样.jpg
注意:
额外添加噪波就是在采样过程中添加一下额外的噪波,让模型采样能生成更多的细节。
如果觉得画面太乱可以不添加。


基础模型生图
面部参考图:
基础人物参考.jpg
姿势参考图:
基础姿势参考.jpg
服装参考图:
基础服装参考.jpg

基础参考图加载.jpg


示例:
基础生图示例.jpg
图像尺寸:
基础出图尺寸01.jpg
我们让生图尺寸匹配姿势参考图的尺寸,这样生图的位移最小。
基础出图尺寸02.jpg
提示词:


  1. 图1的女性,姿势参考图2,服装参考图3,脚穿黑色高跟鞋。
  2. **姿态、动作、身材**:
  3. 坐在地上,坐姿,双腿自然分开呈“V”字形,身体微微前倾;右手轻抚胸前,左手随意搭在大腿处
  4. **场景环境**:  
  5. 画面背景是阳光明媚的户外场景,两侧环绕着茂密的绿色灌木丛与高大树木,远处隐约可见建筑物,整体环境清新自然,充满生机。
复制代码


注意:要选择2511模式


Qwen-Rapid-AIO-NSFW-V20模型生图
这次我们让这个女孩坐在室内的沙发上全身裸体。
面部参考图:
V20人物参考.jpg
姿势参考图:
V20姿势参考.jpg
因为是要女孩全裸注意把服装参考图禁用。
V20参考图加载.jpg
示例:
V20生图示例.jpg
提示词:

  1. 图1的女性,姿势参考图2,
  2. 女性全身裸体
  3. **姿态、动作、身材**:
  4. 坐在沙发上
  5. **场景环境**:  
  6. 室内空间,浅灰色墙面搭配木质地面,左侧可见大型绿植(似龟背竹),背景有深色门框与台阶,营造温馨现代氛围。  
复制代码


我们在来生成一张成人图片
参考图:
V220成人参考图.jpg
这次我们把姿势参考也禁用了
示例:
成人.jpg
提示词:
  1. 图1的女性和男人发生性关系的照片。
  2. 图1的女性坐在沙发上的男人身上,男人的阴茎插入她的阴道。
  3. 图1的女性看着镜头。
  4. 图1的女性全身裸体。
复制代码


*************************************************************************

如果遇到缺少节点可以尽量尝试参考以下帖子自行安装。
comfyui 纯新手教学 第一期 (comfyui环境部署)
comfyui 纯新手教学 第二期 (comfyui插件安装)
如果实在有困难可以在model/工作流文件中下载新的整合包











自行打包证明
打包证明.png































评分

参与人数 30威望 +110 收起 理由
wvwvkk + 5 感谢为论坛添砖加瓦
so195 + 1 老王老王,有你更强!
keycle + 3 老王老王,有你更强!
502620 + 1 膜拜大佬
ZeroW. + 1 老王老王,有你更强!
吊那星 + 1 老王论坛,数你最强!
tnt555 + 10 老王论坛,数你最强!
fallengod + 10 老王论坛,数你最强!
逐浪客 + 1 老王老王,有你更强!
轩峒 + 10 老王老王,有你更强!

查看全部评分

本帖被以下淘专辑推荐:

回复

使用道具 举报

发表于 2025-10-17 14:01:26 手机版 | 显示全部楼层
我去,我终于感受到学霸学习时候的体验了
回复 支持 40 反对 2

使用道具 举报

 楼主| 发表于 2025-10-12 08:27:59 | 显示全部楼层
相关的模型会在这个
https://pan.baidu.com/s/1HWOVEjgNVMHIKSDGqlaPEA?pwd=6wbz 提取码: 6wbz
网盘中免费持续更新!!

回复 支持 27 反对 0

使用道具 举报

发表于 2025-10-13 23:48:13 手机版 | 显示全部楼层
太有技术含量了,感觉不像老王的贴子,像csdn的
回复 支持 21 反对 0

使用道具 举报

发表于 2025-10-26 10:20:35 | 显示全部楼层
老大求助,在做局部重绘时,到这一步,就出现这个错误提示,不会解决了。
ScreenShot_2025-10-26_101634_833.png
ScreenShot_2025-10-26_101715_875.png
回复 支持 20 反对 0

使用道具 举报

发表于 2025-11-5 14:58:30 | 显示全部楼层
6666,竟然还能看到正经学问
回复 支持 11 反对 1

使用道具 举报

 楼主| 发表于 2025-10-17 13:32:46 | 显示全部楼层
lclc1122 发表于 2025-10-17 03:10
真的很谢谢大佬,你这才是真正的社会主义,伟大的开源精神,而且文字指导能力也很强,纯纯嚼碎了喂。{:4_11 ...

如果你的代理有流量限制,比较大的模型就不要用代理下。在C站或者huggingface上找到了大模型就用迅雷下不然你的流量很快就用完了!我会出ubuntu上搭建comfyui的教程。这样租服务器自己搭建会方便点
回复 支持 7 反对 0

使用道具 举报

 楼主| 发表于 2025-10-14 00:19:53 | 显示全部楼层
lance00 发表于 2025-10-13 23:21
为什么我局部重绘和原图差不多,需要改什么数值吗

你局部重绘什么地方?如果是乳头和阴道那需要特别的Lora,我过几天会详细说的
回复 支持 3 反对 0

使用道具 举报

发表于 2025-10-12 18:08:35 | 显示全部楼层
老大又开新贴了,先支持一下,再下载。
回复 支持 3 反对 0

使用道具 举报

发表于 2025-10-17 16:01:47 | 显示全部楼层
pally2024 发表于 2025-10-15 22:57
大佬,到这一步还是不会搞,怎么解决啊,工作流和模型加载不了啊

这个我学会了,ctrl+O打开工作流就行了。
回复 支持 2 反对 0

使用道具 举报

发表于 2025-10-12 18:01:21 手机版 | 显示全部楼层
楼主厉害的
回复 支持 2 反对 0

使用道具 举报

发表于 2025-10-12 13:16:03 手机版 | 显示全部楼层
很厉害
回复 支持 反对

使用道具 举报

发表于 2025-10-12 14:46:29 | 显示全部楼层
期待楼主好玩的lora啊,谢谢啦,千问那个直接可以去衣,就是身体的细节不够强
回复 支持 0 反对 1

使用道具 举报

发表于 2025-10-12 17:33:52 | 显示全部楼层
太厉害啦,感谢指引~
回复 支持 反对

使用道具 举报

发表于 2025-10-12 23:25:54 | 显示全部楼层
支持大佬
回复 支持 1 反对 0

使用道具 举报

发表于 2025-10-12 23:55:00 手机版 | 显示全部楼层
我去,牛批
回复 支持 1 反对 0

使用道具 举报

发表于 2025-10-13 01:24:10 手机版 | 显示全部楼层
太喜欢大佬的教程了,每天都在等更新
回复 支持 反对

使用道具 举报

发表于 2025-10-13 02:10:25 手机版 | 显示全部楼层
炸了,什么情况才一天不到啊佬
回复 支持 反对

使用道具 举报

发表于 2025-10-13 02:24:06 手机版 | 显示全部楼层
哦又好了
回复 支持 反对

使用道具 举报

发表于 2025-10-13 07:30:08 | 显示全部楼层
老大,我虽然接触还不到一个星期,但跟着你学习真的非常之受益非浅,希望多出教程,教育嘛 ,得众基础抓起。凡是老大的讲的,都能听明白,也能跟着做出来,但有的一笔带过,就不知道从何处下手,比如代理这个事,不知道怎么才能使用代理呀。
回复 支持 反对

使用道具 举报

 楼主| 发表于 2025-10-13 11:47:32 | 显示全部楼层
小雨点 发表于 2025-10-13 07:30
老大,我虽然接触还不到一个星期,但跟着你学习真的非常之受益非浅,希望多出教程,教育嘛 ,得众基础抓起 ...

你是用什么翻墙的,每款翻墙软件本地的监听端口都不一样。你是用什么翻墙的?

回复 支持 反对

使用道具 举报

发表于 2025-10-13 15:06:04 | 显示全部楼层
wulesoicq 发表于 2025-10-13 11:47
你是用什么翻墙的,每款翻墙软件本地的监听端口都不一样。你是用什么翻墙的?

...

老大,这个我真不怎么懂,就是从网上下了个叫‘小熊加速器’的,还是收费的那种,怎么才能知道他用的端口呢?我找半天,也找不到呀?
回复 支持 1 反对 0

使用道具 举报

发表于 2025-10-13 22:44:29 | 显示全部楼层
今天又有收获,明天继续学习。
回复 支持 反对

使用道具 举报

发表于 2025-10-13 23:21:03 | 显示全部楼层
为什么我局部重绘和原图差不多,需要改什么数值吗
回复 支持 反对

使用道具 举报

发表于 2025-10-14 00:14:49 手机版 | 显示全部楼层
楼主,那个ai仙剑的是怎么做的啊。感觉光影7啥的很不错。还能支持中文
回复 支持 反对

使用道具 举报

您需要登录后才可以回帖 登录 | 免费注册
点击进行验证

本版积分规则

我们不生产资源,只做资源的搬运工。

广告合作-tags标签-app下载-Archiver-小黑屋-