midjourney提示词需结构化:先用具体名词锁定主体,再剔除无效形容词,补唯一光源或景深线索;采用主谓宾压缩或属性分层法组织短语,避免宽泛文化词,用物理可验证特征替代抽象风格描述。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

写Midjourney提示词时,如果只写“一只猫”“风景很美”“赛博朋克风格”,生成图往往模糊、随机、偏离预期——因为模型无法从空泛描述中提取构图、光影、材质、视角等可执行信号。
先锁定核心视觉锚点
第一步:用名词短语明确主体,且必须具体到可识别的实体。比如不写“鸟”,写“红冠犀鸟(Rhinoplax vigil)站在枯枝上”;不写“建筑”,写“1930年代上海外滩汇丰银行大楼穹顶+铜质旋转门+雨天反光水洼”。空泛名词会让Midjourney自由发挥,结果不可控。
第二步:剔除所有形容词堆砌。删掉“非常”“极其”“超现实般”这类无效修饰——它们不提供像素级信息。Midjourney不理解程度副词,只响应具象词汇触发的CLIP嵌入向量。
第三步:补一个不可省略的视觉锚点:要么是【唯一光源方向】(如“侧逆光”“顶光带硬阴影”),要么是【明确景深线索】(如“f/1.2浅景深”“背景虚化含咖啡馆玻璃倒影”)。没有这个,画面容易平面化、无空间感。
用结构化短语替代长句描述
方法一:主谓宾压缩法。把“我想看到一个穿红色斗篷的女巫在暴风雨中骑扫帚飞过古堡”改成:“red-cloak witch → riding broomstick → stormy sky → Gothic castle ruins below → motion blur on cloak”。箭头表示视觉动线,每个短语都是独立token,模型更易解析。
方法二:属性分层法。用括号分组关键属性,格式为:主体(材质+纹理+颜色)+ 场景(时间+天气+地理特征)+ 镜头(焦距+角度+运动)。例如:“cybernetic samurai(oxidized copper plating, micro-scratches, matte black underlayer)+ Neo-Kyoto alley(3am, neon rain puddles, steam vents)+ 35mm lens, low angle, slight Dutch tilt”。
注意:括号内不要用顿号或“和”,用英文逗号分隔不同维度属性,否则Midjourney会混淆为并列主体。
规避常见语义陷阱
写“中国风”会混入大量非预期元素(青花瓷纹样、竹林、水墨晕染),实际想要的是宋代汝窑釉色+极简器型+哑光陶土质感→直接写“Song Dynasty Ru ware vase, celadon glaze, unglazed foot, studio lighting, macro shot”。
避免使用文化符号类宽泛词:“北欧风”“工业感”“复古”——这些在训练数据中关联过杂。改用物理可验证特征:“exposed riveted steel beams + concrete floor with sawcut lines + pendant lamp with brass cage”。
不写“高清”“8K”“杰作”——这些是质量指令,不是视觉指令。Midjourney v6已默认启用--style raw,真正提升精度的是“shot on Hasselblad X2D, ISO 64, f/8”这类具象设备参数。











