短视频脚本必须用分镜表格呈现,每行包含时间码、景别、主体动作、台词、音效五要素,动作需精确到人物+道具+动作+画面特征+时长,禁用模糊描述与主观判断。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

通义千问生成的短视频脚本提示词经常只写“开头吸引人→中间讲三个卖点→结尾引导点赞”,实际拍出来节奏散、信息空、镜头没法落地,根本没法直接交给编导或剪辑执行。
把“讲三个卖点”拆成可拍摄的动作指令
不要写“介绍产品优势”,要写“主播左手拿起咖啡机,右手按下萃取键,特写咖啡液滴入杯中(时长1.8秒)”。这一步必须具体到手部动作、道具状态、镜头类型和精确时长——剪辑师才能按帧找素材,摄像才知道该架几个机位。【没写镜头类型和时长的卖点描述,等于没写】
用“人物+道具+动作+画面特征”五要素补全每条卖点:比如“宝妈单手抱娃→腾出右手拧开奶粉罐→罐口朝镜头倾斜30度→白色粉体簌簌落下(慢动作)”。
用分镜表格替代段落式描述
方法一:在通义千问输入框里直接粘贴表格模板再填空:
|时间|画面|台词|音效|备注|
|0:00-0:03|手机屏幕弹出红点通知|“叮!”|消息提示音|用iPhone 15实拍|
|0:04-0:07|手指划开通知→停在“限时免单”页面|“就现在!”|划屏音效|指甲涂裸色甲油|
方法二:先让通义千问输出纯文本脚本,再用Excel手动转成四列:时间码、画面动作、人声台词、环境音效。这步不能跳过——【表格强制暴露逻辑断层,比如发现“0:12-0:15”写着“讲解原理”,但前后都没对应画面,立刻能删掉虚话】
给AI加硬性约束条件
第一步:在提示词开头明确写死限制项,例如:“输出格式必须为表格,共5列:时间码(精确到0.1秒)、景别(近景/特写/全景)、主体动作(主语+动词+宾语)、台词字数≤12字、音效类型(环境音/拟音/静音)”。
第二步:追加否定指令:“禁止出现‘用户会喜欢’‘观众觉得有趣’等主观判断;禁止使用‘比如’‘类似’等模糊举例;所有时间码必须累加且无重叠”。
第三步:要求AI自我校验:“检查每行台词是否能在3秒内说完(按中文280字/分钟语速折算),超时则拆分为两行”。











