必须先让ai输出6部分纯文字提纲,再据此生成逐项绑定的分镜提示词:①开场镜头(3秒);②核心动作a(8秒);③核心动作b(8秒);④特写细节(5秒);⑤收尾镜头(4秒);⑥整体节奏说明(2句以内),主题为“v60手冲埃塞俄比亚耶加雪菲”,风格干净、自然光、无旁白、无文字标注。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

想用Vidu生成一段30秒左右的咖啡冲煮短片,但直接输入“手冲咖啡过程”容易让AI跳过结构设计、直接输出零散画面,导致成片节奏混乱、重点缺失。必须先让AI输出清晰提纲,再基于提纲生成分镜脚本和画面提示词。
强制AI先输出文字提纲
在Vidu输入框里,第一句话就明确限定输出格式:“请只输出以下6个部分组成的纯文字提纲,不要任何解释、不要代码块、不要额外符号:①开场镜头(3秒);②核心动作A(8秒);③核心动作B(8秒);④特写细节(5秒);⑤收尾镜头(4秒);⑥整体节奏说明(2句以内)。”
这一步不能省略或软化语气——Vidu对模糊指令响应差,写“建议你先列个提纲”或“可以先想想结构吗”会被忽略,【必须用“请只输出……不要……”的强约束句式】。
接着补上具体需求:“主题是‘用V60手冲一杯埃塞俄比亚耶加雪菲’,风格干净、自然光、无旁白、无文字标注。”
提纲生成后立刻锁定结构
拿到AI返回的提纲后,立刻复制全部内容,在新对话中粘贴并追加指令:“严格按以下提纲生成Vidu可用的分镜提示词,每段提示词对应提纲中一项,共6段,每段开头标注‘镜头1:’‘镜头2:’等,只输出提示词,不加说明。”
例如提纲里写“④特写细节:滤纸边缘水流缓慢渗透”,对应提示词就得是“特写,V60滤杯侧边,浅棕色水流沿滤纸纤维缓慢下渗,背景虚化,柔光窗景”。
如果AI擅自合并镜头或添加未在提纲里的内容,就删掉重发,【提纲一旦确认,后续所有提示词必须逐项绑定,不可跨项糅合】。
避免提纲被绕过的两个关键操作
方法一:在首次提问末尾加一句否定排除:“不输出视频描述,不输出画面建议,不输出拍摄技巧。”
方法二:把提纲要求拆成两轮——第一轮只问“列出6个时间分区的镜头名(如‘湿布擦拭滤杯’),每个不超过8个字”,第二轮再让AI填充每项的具体画面要素。
这一步很多人跳过,结果AI用“温暖色调”“专业感”之类空泛词凑数。必须逼它写出可视觉化的名词动词组合,比如“不锈钢壶嘴悬停距滤纸2cm”比“优雅注水”管用十倍。











