【指令】咖啡师双手制作手冲咖啡全过程,包含磨豆:1.4→注水:1.2→萃取:1.0→倒杯:0.8四个阶段,每个阶段持续3秒,镜头随动作推进---【约束】禁用全景俯拍、禁用人物面部特写、禁用文字标注;每阶段必须含1个微距镜头:刀盘飞溅的咖啡粉:1.6, 水流冲击滤纸:1.5, 液面缓慢上升:1.3, 液面涟漪:1.1---【风格】胶片旁轴摄影质感,颗粒感适中,浅景深,f/1.8,自然窗光从左前方45度入射;升格镜头(120fps)用于磨豆与注水阶段,标准帧率(24fps)用于萃取与倒杯阶段;镜头焦距随阶段递进:24mm→50mm→90mm→100mm微距
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你需要即梦AI生成一段咖啡制作短片,但发现输出内容要么全是宏观镜头、要么堆砌琐碎动作,缺乏从整体流程到关键细节的节奏层次——这说明提示词缺少对叙事层级的显性控制。
用【指令】/【约束】/【风格】三层区块强制分层
即梦AI会把带方括号的标签识别为语义区块分隔符,不同区块触发模型内部不同的attention分配策略。不加区块时,所有词元混在一条语义链里,AI无法区分“哪里该交代流程”和“哪里该放大特写”。【必须用英文方括号,中文括号无效】
第一步:在输入框第一行写【指令】咖啡师双手制作手冲咖啡全过程,包含磨豆→注水→萃取→倒杯四个阶段,每个阶段持续3秒,镜头随动作推进
第二步:换行输入---(三个短横线,不可用其他符号)
第三步:换行写【约束】禁用全景俯拍、禁用人物面部特写、禁用文字标注;每阶段必须含1个微距镜头:磨豆阶段拍刀盘飞溅的咖啡粉,注水阶段拍水流冲击滤纸的瞬间,萃取阶段拍液面缓慢上升,倒杯阶段拍咖啡注入白瓷杯时的液面涟漪
第四步:再换行输入---
第五步:换行写【风格】胶片旁轴摄影质感,颗粒感适中,浅景深,f/1.8,自然窗光从左前方45度入射
用数值权重锚定各层优先级
同一句话里不同元素的视觉权重必须拉开差距,否则AI会平均分配注意力,导致“磨豆”和“倒杯”在画面中占比雷同。数值权重直接干预token attention score,是控制层级最硬的手段。
方法一:在【指令】区块内,给阶段动词加权。例如:“磨豆:1.4 → 注水:1.2 → 萃取:1.0 → 倒杯:0.8”,这样AI会自动延长磨豆镜头时长、压缩倒杯时长
方法二:在【约束】区块内,对微距对象做反向压制。例如:“刀盘飞溅的咖啡粉:1.6, 水流冲击滤纸:1.5, 液面缓慢上升:1.3, 液面涟漪:1.1”,确保越靠前的阶段细节越炸裂
【注意:权重值必须控制在0.8~1.8之间,低于0.8易被忽略,高于1.8会导致局部过曝或结构畸变】
用镜头参数绑定时间与空间层级
短片的“层”不仅是内容切分,更是光学逻辑的叠加。即梦AI能解析镜头参数与时间节奏的耦合关系,比如“升格镜头”天然对应慢动作特写,“广角镜头”必然带入环境信息。
在【风格】区块末尾追加:“升格镜头(120fps)用于磨豆与注水阶段,标准帧率(24fps)用于萃取与倒杯阶段;镜头焦距随阶段递进:24mm→50mm→90mm→100mm微距”
这组参数会强制AI生成四段节奏分明的画面:开头用广角交代工作台全貌,中间两段用中焦聚焦手部与器具交互,结尾用百毫米微距把咖啡液面涟漪放大到占据画面70%面积——空间压缩感自然形成视觉纵深。











