关键在于精准匹配提示词意图与模型能力边界:先据需求选模型(人像/写实/动漫),再设适配画幅与质量参数,cfg scale控制在7~10并必配负面提示词,采样步数以30为临界点,负面词分基础、人像、杂志风三类必填。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

想让扣子图像生成插件稳定输出高质量、风格可控的图片,关键不在堆参数,而在精准匹配提示词意图与模型能力边界。盲目调高采样步数或提示词相关性,反而容易导致画面僵硬、细节过载或构图失衡。
模型选择:先定“画师”,再谈调参
第一步打开插件节点,点击【模型】下拉菜单——不要直接选最热门的“即梦5.0”或“SDXL”。先看你的需求:要画真人写真,选【人像模型】;做电商主图,选【写实模型】;出IP形象或角色设定,才用【动漫模型】。通用模型对模糊描述容忍度高,但细节控制弱,新手误用后常出现手指畸变、光影错乱等问题。
即梦5.0虽强,但对中文提示词的胶片颗粒、柔焦等质感词理解偏保守,若你明确需要“宝丽来复古噪点”效果,反而要切回即梦3.0并手动加grain, vintage film。
画幅与质量:两个数值决定成败起点
画幅不是随便选个9:16就完事。杂志封面必须用【9:16】,但人物特写若强行拉长,AI会自动压缩肩颈比例造成头大身小;做海报横版则必须选【16:9】,否则AI在1024×1024下会把主体塞进中心圈,四周留白死板。
生成质量参数默认25,这是速度与精度的黄金平衡点。调到35以上时,单张图耗时翻倍,但面部毛孔、发丝边缘等细节提升不足5%,反而易引入高频噪点;若你只要快速出草稿用于内部评审,直接设为15即可——这一步操作起来很简单,直接拖动滑块到15就行。
提示词相关性(CFG Scale):7~10是安全区
CFG Scale控制AI对提示词的服从程度。设为15以上,画面可能机械生硬,人物表情像面具;低于5则容易跑偏,比如输入“穿红裙的舞者”,结果裙子变蓝、动作僵直。
真正关键的是【必须配合负面提示词使用】:当CFG Scale设为8时,负面词填入deformed, extra fingers, blurry background,能有效压制常见幻觉;若不填负面词,哪怕CFG Scale=10,手部仍大概率多指。
采样步数:30步是性价比临界点
第一步:先固定其他参数,只调采样步数,从20开始试跑三张图;
第二步:观察画面中金属反光、玻璃透光、布料褶皱这三处细节是否连贯——若20步已清晰,再加步数纯属浪费算力;
第三步:若20步出现明显色块断裂(如衬衫领口与脖子交界处发灰),升至30步;超过30步后每+5步,出图时间增加约12秒,但细节提升肉眼难辨。
注意:即梦系列模型在40步后会出现“过度锐化”现象,皮肤纹理变成砂纸质感,此时必须同步降低CFG Scale至6.5以下才能挽救。
负面提示词:三类词必须写死
方法一:基础保底型
直接复制粘贴这组:worst quality, low resolution, text, signature, watermark。适用于所有场景,防止AI偷偷加水印或生成模糊大图。
方法二:人像专用型
在基础型上追加:deformed hands, mutated fingers, bad anatomy。尤其当提示词含“双手交叉”“托腮”等手势时,这组词能砍掉90%的手部错误。
方法三:杂志风强化型
针对写真类需求,加入:flat lighting, dull colors, amateur photo。AI会主动规避平光、灰暗、业余感,强制启用侧逆光与胶片色谱。











