根本原因是模型对“高清人脸”缺乏显式约束,需用结构化提示词重置注意力:人脸权重前置+细节锚点固化,如“ultra-detailed face, pores visible on cheeks, catchlight in eyes”,并禁用削弱项与特定负面词。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

通义万相生成人像摄影图时脸部细节模糊,根本原因是模型对“高清人脸”缺乏足够强的显式约束,尤其当提示词中混入大量环境、风格、光影等干扰项后,人脸权重被稀释。必须用结构化提示词重置模型注意力,优先锁定面部区域的解析精度。
核心原则:人脸权重前置+细节锚点固化
第一步:把“ultra-detailed face”或“photorealistic facial skin texture”放在提示词最开头,不加逗号隔开,强制模型从第一个token就开始聚焦人脸;【位置越靠前,权重越高,放中间或结尾基本无效】
第二步:紧接插入微观细节锚点词,如“pores visible on cheeks”“subtle freckles on nose bridge”“catchlight in eyes”,每个词对应一个可验证的物理特征,避免抽象词如“realistic”“natural”;
第三步:删除所有削弱人脸权重的冗余描述,例如“soft background blur”“cinematic shallow depth of field”——景深控制会触发模型自动弱化背景以外区域的锐度,反而连带模糊人脸边缘。
Vidu视频生成插件(viduq3-pro、viduq3-turbo、viduq2、viduq1)。支持文字转视频、图片转视频、参考转视频以及起始编辑。
快速修复模板(直接复制替换)
方法一(基础强化版):
ultra-detailed face, pores visible on cheeks, catchlight in eyes, subsurface scattering on earlobes, Canon EOS R5, 85mm f/1.2 → 保留人物主体描述(如“Chinese woman in silk hanfu”),删掉所有关于氛围、情绪、整体构图的形容词。
方法二(高危场景专用):
photorealistic facial skin texture, individual eyelashes, defined nasolabial folds, slight skin translucency on temple → 人物描述后追加“--no hands, --no jewelry, --no complex hair accessories”,排除手部、配饰、繁复发型等高频干扰源,防止模型分配算力到非人脸区域。
必须关闭的负面提示词
在Negative prompt栏中,逐字输入以下内容:
deformed face, blurry face, low-res face, cartoon, illustration, anime, painting, sketch, text, watermark, logo, extra fingers, mutated hands
特别注意:“blurry face”和“low-res face”必须存在,否则模型默认接受一定模糊度;【不写这两项,其他所有正面优化都会打折扣】










