|
|
马上注册,结交更多好友,享用更多功能,让你轻松玩转社区。
您需要 登录 才可以下载或查看,没有帐号?免费注册
x
本帖最后由 wulesoicq 于 2026-9-30 13:22 编辑
Qwen_Image_2.1详细教学 我个人玩图像模型喜欢像玩HS2这种游戏一样主要享受捏人的过程。
所以喜欢搜集人物,装备,然后一件一件换装备,感觉才带劲。不太喜欢纯粹的文生图。
原来人物、装备都要自己训练Lora,后来出了Qwen_Image_Edit2511就一直用2511,
Qwen_Image_Edit2511,低频细节很垃圾,但图像编辑能力要远远超过其它其它开源模型。
现在Qwen_Image_2.1不仅继承了2511的优点,而且低频细节,美学特征也不输其它开源模型了。
终于可以淘汰2511了。
模型下载
国内的小伙伴可以到魔搭社区
Comfy-Org/Qwen-Image-2.1 的仓库下载对应的模型,速度很快我就不转存。
注意:
有条件的尽可能下载bf16的模型。
qwen_image_2.1_pe_i2i和qwen_image_2.1_pe_t2i,分别是图生图和文生图的提示词优化的模型注意区分。
文生图
模型选择
注意:
提示词增强要选择qwen_image_2.1_pe_t2i
采样参数
注意:
生成图像尺寸推荐200万-400万像素。
提示词增强建议开启。
采样步数comfyui官方给的是25步,个人感觉太少建议30-40步比较合适。
示例1(无提示词增强)
提示词
- 一位年轻中国女性的正面半身至大腿裸体肖像照。背景为纯灰色,整体呈现柔和、干净的人像摄影风格,人物身材纤细,瘦弱,四肢纤细修长,肋骨明显,皮肤白皙光滑。
- 人物发型:
- 深棕色披肩直发,中分刘海自然垂落于脸颊两侧,发丝顺滑贴服。
- 人物妆容:
- 妆容清淡自然,底妆白皙通透,眉毛为柔和的平眉,眼妆淡雅,眼线和睫毛自然,唇色为淡粉橘色,整体呈现清透的伪素颜妆效。
- 人物表情:
- 表情平静淡然,双眼平视镜头,眼神清澈略带无辜感,嘴唇微闭,面部无明显情绪波动,呈现中性、温婉的神态。
- 人物姿态:
- 正面站立,身体略微放松,双肩自然下垂,双臂垂于身体两侧,双手自然微张置于大腿外侧,手指放松,胸部自然挺立,整体姿态端正。
- 人物服装:
- 裸体,未穿着任何衣物,全身皮肤裸露,呈现自然的肤色与身体线条。
- 场景环境背景:
- 背景为纯灰色无缝影棚背景,色调统一,无纹理、无渐变明显痕迹,营造极简的摄影棚氛围。
- 风格:
- 极简人像摄影风格,偏向自然主义与唯美主义结合,构图居中对称,色调柔和低饱和。
- 光影:
- 柔和的正面漫射光为主,光线均匀洒在人物面部与身体上,阴影柔和不强烈,锁骨、胸部、腹部与大腿处有细腻的明暗过渡,皮肤呈现自然的高光与立体感,整体光比低,氛围温柔。
复制代码
图像示例
示例2(提示词增强)
提示词
提示词增强
- The image is a vertically oriented, realistic portrait photograph taken indoors beside a large window. On the left side, a tall rectangular window occupies much of the height of the frame, with a dark black or charcoal-colored frame and a visible metal handle near the lower-left-middle area. Bright daylight streams through the glass from outside, where soft green tree foliage appears blurred in the background. The strong natural light creates warm highlights on the subject’s skin and casts gentle shadows across the nearby wall. In the center of the image, a young adult woman who appears East Asian stands facing the camera in a straight-on pose. She has long, dark brown to black hair worn loose, slightly tousled, and parted near the center, with strands falling around her face and over her shoulders. Her face is oval-shaped with soft features, dark eyes, natural eyebrows, a small nose, and a relaxed closed-mouth smile. Her skin tone is light to medium with a smooth texture, and the sunlight emphasizes subtle facial contours and a natural glow. She wears minimal, natural-looking makeup with softly defined eyes, lightly tinted lips, and a fresh complexion. Her build is slim, and she is shown from the head down to the upper thighs in a nude portrait without clothing or accessories. Her shoulders, collarbones, arms, abdomen, hips, and upper thighs are visible. She stands upright with her arms angled downward and her hands gently touching or overlapping in front of her lower abdomen/upper thigh area. Her posture is calm and composed, and she looks directly toward the camera with a gentle, relaxed expression. The background on the right side is a plain off-white or beige interior wall with a smooth matte texture, faint small marks, and soft shadow gradients. The overall composition places the subject centrally, slightly closer to the window light on the left, while the wall forms a clean negative space on the right. The color palette is warm and natural, dominated by sunlit skin tones, cream walls, dark hair, and muted green outdoor foliage. The photographic style is high-resolution, realistic, softly lit, and editorial-like, with shallow depth of field, natural window illumination, and a calm lifestyle portrait atmosphere.
复制代码
注意:
提示词增强是根据Qwen_image_2.1的提示词规则进行的后训练,并没有成人内容。
即使你使用abliterated的模型,只是不会拒绝你的请求,并不会帮你把做爱的场景细化丰富。
所以我都只用官方的提示词增强模型,成人内容还是自己手写提示词。
图像示例
整体图像编辑
模型选择
注意:
提示词增强要选择qwen_image_2.1_pe_i2i
参考图上传
注意:
官方说明支持10张参考图,个人觉得不要超过3张,参考图多了生图速度慢,而其效果也不好。
不需要的参考图上传节点用 ctrl+C 忽略掉
采样参数
注意:
如果人脸占比小可以适当提高生图像素200万-400万像素。
采样步数可以选择比文生图高些,40-50步左右比较合适,步数少了修改人物姿势人物肢体会崩坏。
示例1
我们先玩下传统的传统的控制生图。
我个人的性癖是比较喜欢骨感瘦弱的女孩,刚才文生图的图像对我来说还是有点胖了。
所以我用骨感女孩的深度图,重新生成。
参考图
提示词
- 一位年轻中国女性的正面半身至大腿裸体肖像照。背景为纯灰色,整体呈现柔和、干净的人像摄影风格,人物身材纤细,瘦弱,四肢纤细修长,肋骨明显,皮肤白皙光滑。
- 人物发型:
- 深棕色披肩直发,中分刘海自然垂落于脸颊两侧,发丝顺滑贴服。
- 人物妆容:
- 妆容清淡自然,底妆白皙通透,眉毛为柔和的平眉,眼妆淡雅,眼线和睫毛自然,唇色为淡粉橘色,整体呈现清透的伪素颜妆效。
- 人物表情:
- 表情平静淡然,双眼平视镜头,眼神清澈略带无辜感,嘴唇微闭,面部无明显情绪波动,呈现中性、温婉的神态。
- 人物姿态:
- 正面站立,身体略微放松,双肩自然下垂,双臂垂于身体两侧,双手自然微张置于大腿外侧,手指放松,胸部自然挺立,整体姿态端正。
- 人物服装:
- 裸体,未穿着任何衣物,全身皮肤裸露,呈现自然的肤色与身体线条。
- 场景环境背景:
- 背景为纯灰色无缝影棚背景,色调统一,无纹理、无渐变明显痕迹,营造极简的摄影棚氛围。
- 风格:
- 极简人像摄影风格,偏向自然主义与唯美主义结合,构图居中对称,色调柔和低饱和。
- 光影:
- 柔和的正面漫射光为主,光线均匀洒在人物面部与身体上,阴影柔和不强烈,锁骨、胸部、腹部与大腿处有细腻的明暗过渡,皮肤呈现自然的高光与立体感,整体光比低,氛围温柔。
复制代码
图像示例
明显骨感多了
示例2
再来试试姿势图控制,虽然可以直接参考图像,但我还是习惯参考骨骼图。
参考图
提示词
- 图1女性角色 姿势参考图2 单脚直立支撑身体,另一条腿向后上方伸展并由双手抓住脚部
复制代码
提示词增强
- 在<image1>上,将站立人物的当前直立姿态替换为<image2>中人物的站立竖叉舞姿:人物以一条腿垂直向下站立承重,支撑脚掌贴合地面,另一条腿从髋部完全向上伸直举至头顶高度,抬起腿的大腿与小腿保持同一直线,抬起腿的脚踝处被一只手握持固定,另一只手臂向上伸展并弯曲举过头顶,躯干随抬腿动作向支撑腿一侧轻微倾斜,头部正对镜头。该操作仅转移姿势,保持<image1>中人物的面部特征、表情、长直黑发、肤色、纤细体型比例完全不变,不添加任何服装、道具。新姿势下的人体解剖结构必须自然合理,肩、肘、腕、髋、膝关节弯曲协调,身体重心稳定落在支撑脚上。光照适配:<image1>的柔和正面影棚光保持不变,人物身体上的高光与阴影随新姿势的肢体朝向自然重新分布,支撑脚底部在地面产生与光源方向一致的接触阴影。保持<image1>的灰色纯色背景、地面及整体取景构图完全不变。
复制代码
图像示例
示例3
我们来试试多人物迁移和背景融合
参考图
提示词
提示词增强
- 将<image1>中的女性和<image2>中的女性置入一个现代家居客厅场景中,生成一张两人并排坐在沙发上聊天的合影照片。将<image1>中的女性安排在画面左侧的沙发座位上,身体略微转向右侧,双手放松地搭在膝盖上,双脚踩在地毯上;同时将<image2>中的女性安排在画面右侧的沙发座位上,身体略微转向左侧,双手交叠放在腿上,两人肩部距离靠近,视线朝向对方,呈现轻松交谈的状态。两人臀部稳稳压陷沙发坐垫,脚部与地面之间有明确的接触阴影,身高比例与体型保持与各自源图一致并缩放至同一尺度。两人所坐的米白色布艺三人沙发带有原木色扶手,沙发后方是客厅背景:画面前方摆着一张原木色圆形茶几,茶几上放着一套白色陶瓷茶杯,画面左后方立着一盏黑色金属杆落地灯,灯罩为米白色布艺材质,地面铺着浅灰色短绒地毯,右后方墙面上挂着一幅黑色细框装饰画,旁边是一扇挂着米色布帘的窗户。光线为室内暖色照明,主光从画面左上方柔和洒落,在人物面部和肩颈处形成柔和高光,并在沙发底部和地毯上投下方向一致的浅淡阴影,整体色调温暖统一,呈现真实摄影质感。保持<image1>中人物的外观完全不变,保持<image2>中人物的外观完全不变。
复制代码
图像示例
人物一致性不错,环境融合也可以,在开源模型中可以算是顶级的了。
其它还有很多的整体的图像编辑的玩法,比如风格重绘,高清放大等,在这里就不演示了。
局部图像编辑
换装,换脸等局部的图像修改,也可以用传统的图像编辑实现。
但如果原始图像尺寸太大,或者需要修改的区域占比小,那么局部重绘显然更加适合。
模型选择
和整体图像编辑的模型相同
参考图上传
采样参数
注意:
裁剪系数是在遮罩的基础上扩大一定的倍数裁切。
参考图分别率是局部采样过程的放大尺寸,不影响最后出图尺寸。
我用了很大的参考图3240X5760,但采样只真对裁切的那一部分。
推荐1024-2048,数值越大采样速度越慢。
必要的第三方插件
ComfyUI-Impact-Pack:局部重绘
ComfyUI-Inpaint-CropAndStitch:遮罩裁剪
注意:
我分享的工作流一般都会用官方的节点,但这两个插件用官方的节点替代会很麻烦,可以通过插件管理安装。
示例1
换脸是我们常用的玩法,个人感觉用局部重绘的方式效果比较好。
参考图
遮罩
提示词
提示词增强
- 在<image1>上,将人物的面部和头发整体替换为<image2>中女性的面部和头发。替换后的面部(含脸颊星形贴饰)与金色长发、齐刘海发型(含发间银色发饰)必须与<image2>完全一致,同时自然融入<image1>的光照环境和正面头部朝向。保持<image1>中人物的身体、肩颈姿态、灰色背景及所有非面部非头发元素完全不变。
复制代码
图像示例
注意:
有的时候换头后头会显得太大,可以多次抽卡以获得最好的效果。
也可以略微降低采样强度,使用0.98,0.95的降噪强度就会有很好的改善。
头发和面部是强关联,强烈建议面部和头发一起换,遮罩完整的涂满头发和面部区域。
示例2
我们在换完脸的人物图像上穿装备。
先穿袜子和鞋子
参考图
遮罩
提示词
- 将图1女性穿上图2的袜子和图3的高跟鞋,保持图1女性脚部朝向不变。
复制代码
提示词增强
- 在<image1>上,将<image2>中的白色半透明长袜穿到女性裸露的小腿和脚上,再将<image3>中的高跟鞋穿到裹着袜子的脚上。<image2>的长袜顶部为不透明白色宽平袜口,袜身为轻薄透肉的白色织物;穿着时袜口固定于女性膝盖下方,袜身紧贴小腿、脚踝与足部轮廓,半透明袜体透出<image1>腿部肤色,脚尖与脚跟区域自然贴合脚部曲线。<image3>的高跟鞋为银白色光泽尖头细高跟鞋,鞋头饰有淡紫色与浅蓝色亮片花瓣簇和紫色缎面花朵,鞋面正中镶嵌粉色椭圆形宝石并由小珍珠环绕,外侧垂挂粉色水滴形水晶链并连接带扣银色踝带,后跟侧饰有淡紫色半透明纱质蝴蝶结;穿着时鞋口贴合裹袜的足部,尖头朝向镜头对应<image1>的脚部朝向,鞋底接触灰色地面,细高跟直立于脚跟后方。保持<image1>中女性脚部朝向不变,维持双脚平行、脚尖正对镜头的站姿,鞋子按此正面朝向渲染,踝带与垂坠水晶分布于脚部两侧。袜子的透光质感与鞋子的光泽适配<image1>的柔和影棚光照环境,高光方向与<image1>光源一致,脚部与鞋子在灰色地面上投下与<image1>现有阴影方向一致的柔和接触阴影。保持<image1>中女性腿部皮肤质感、双腿站立姿态、灰色渐变影棚背景完全不变。
复制代码
图像示例
鞋子在图像的占比本来就低,而且这鞋子比较复杂,所以用局部重绘,细节就会保留的更好。
示例3
我们继续穿装备
参考图
遮罩
提示词
- 将图1女性穿上图2的服装,保持图1女性的身材姿势不变
复制代码
提示词增强
- 在<image1>上,将人物当前裸露未着衣物的状态替换为穿上<image2>中的整套粉色服装。从<image2>提取的服装为:粉色三角比基尼上衣,由两个三角形罩杯、罩杯下方的细带连接绳和两侧垂下的粉色系带组成;外搭的粉色挂脖式上衣,边缘饰有白色褶边,胸口中央一个深酒红色缎面蝴蝶结,蝴蝶结带上带有黑色细条纹;下身为粉色荷叶边短裙,腰头为光滑平直边,裙摆呈多层褶皱散开。将这套服装穿着到<image1>人物的身体轮廓上:比基尼罩杯贴合人物胸部,挂脖式上衣绕过颈后固定于肩部,短裙腰头对齐人物自然腰线。服装面料的褶皱与垂坠必须跟随<image1>人物当前直立、双臂自然下垂于体侧的姿势产生自然形变,荷叶边裙摆随重力向下垂落。服装的光泽与色彩适配<image1>柔和均匀的影棚光照,在身体与衣物接触处产生与<image1>光源方向一致的高光和阴影,边缘过渡自然无抠图痕迹。保持<image1>中人物的面部、金色长发、头顶银色发饰、耳饰、身材比例、站姿、手臂位置、肤色以及纯灰色背景完全不变。
复制代码
图像示例
进阶篇
人物迁移背景融合
我们在生成完人物的标准图之后接下来就可以用角色来生成写真套图,或者视频生成用的参考图了
先来看看我们用刚才生成的角色生成的三张图
图1
图2
图3
很明显第一张图人物的姿势和原图是一样的,但是和背景的融合效果最差。第二张要比第一张好些。个人感觉第三张效果最好,AI感也最少。
人物的迁移背景融合容易产生违和感的原因,主要有2个
其一:人物的光影、色彩和背景不匹配;
其二:人物和背景的空间透视效果和比例不匹配。
第一张图我们用的提示词
既没有改变人物的姿态动作,也没有强调光影的变化,模型对人物重绘的幅度最少。
所以感觉就像是直接把人物扣下来直接贴到背景上,给人强烈的违和感。
第二张图我们用的提示词
- 图1的女性,坐在椅子上,双腿大幅度分开,直视镜头。
- 场景环境:破旧废弃室内,墙壁剥落发霉,地面散落纸屑与杂物,背景有旧桌椅,整体阴暗凌乱,整体光线偏暗。
- 保持图1的女性 身材,服装不变。
复制代码
我们在迁移人物的同时修改了人物的动作,并且让人物和场景中的物体产生了互动,而且明确了光影特点。
所以人物和场景的融合就比第一张图要好。但是因为模型的能力有限,往往空间透视和物体比例会不正确,比如这里的椅子和背景的墙桌子的比例就有点怪。
第三张图我们是直接让模型参考网络真实人物写真的素材生成
网络素材
刚刚入坑的萌新小伙伴想让出图更加真实,可以选择参考真实拍摄的图像生图。
例如我想生成一张三角木马的SM图,模型不能理解,我也不想费力训练Lora
那么完全可以使用参考图,即使参考图像质量很差,比如这张参考图我是在一部分辨率很低的AV小电影中的截图,清晰度很差。
但生图的效果都要比,费力去写提示词要好
面部二次重绘
人物迁移的面部及身体特征的保持并不是完全“空间不变”的。
人物的面部及身体特征与其空间尺度、位置、姿态、光影等元素都存在耦合。
我们的视觉对面部特征的捕捉又相较于身体或是服装特征更加的敏感。
当目标人物的姿势,尺寸,光影等重绘幅度太大时,模型需要进行更大的跨域映射,导致面部特征的有效利用率下降。
所以我们对人物一致性的保持最重要的就是面部特征。
在人物迁移或使用TTP、SD等重采样的放大之后往往需要对人物的面部进行二次重绘。
给小伙伴们介绍下我的这个专门进行面部重绘的工作流,工作流的原理就是局部重绘只是加入了自动面部遮罩。
如果不想折腾的小伙伴直接用局部重绘也可以达到相同的效果。
模型选择
相关的模型在魔搭社区都有下载,这三个模型怕小伙伴不好找我上传到网盘了。
参考图上传
参数设置
注意:这些参数主要是调整图像裁剪及自动面部遮罩,可以先运行预处理节点,看一下遮罩和素材裁剪是否合适,然后再进行调整。
注意:这些参数是采样参数,可以参考前面的局部重绘工作流,降噪强度推荐1.0-0.85之间。
示例
重绘前
相似度0.599
重绘后
相似度0.368
相似度值和肉眼观察都有明显改善
有什么问题和需要欢迎留言。
祝小伙伴们玩的开心
|
|