用度加ai写短视频脚本需分两步:先以结构化指令生成带镜号、时长、画面、口播的分镜初稿;再人工校准口播口语化、去违禁词、控时长,并将画面描述转为英文关键词生图提示词。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

用度加AI写短视频脚本,核心是把“分镜结构”和“口播生成”拆成两个可控制、可校验的环节——前者决定画面节奏是否抓人,后者决定观众愿不愿意听下去。直接丢一句“写个美妆脚本”大概率产出空洞文案,必须用结构化指令锁定镜头逻辑与语言颗粒度。
第一步:用度加AI生成带分镜结构的初稿
打开度加AI网页端或App,进入「智能创作」→「短视频脚本」模块。
在提示词框里输入完整指令,不要省略任何结构要素: “你是一名抖音竖屏分镜导演,专攻30秒内高完播率内容。请生成1条30秒美妆类口播脚本,严格按以下结构输出: ① 0–4秒:黑眼圈对比特写+反问钩子(镜头:超近景,眼部皮肤纹理清晰,背景纯白); ② 5–12秒:手部动作演示遮瑕步骤(镜头:俯拍中景,手指轻拍,产品LOGO入画); ③ 13–24秒:侧脸微笑+效果对比(镜头:45°侧脸,柔光,左半脸未遮瑕/右半脸已遮瑕); ④ 25–30秒:手指指向镜头+引导收藏(镜头:微仰角,指尖占画面1/3,字幕弹出‘点收藏’)。 每段必须标注【镜号】【时长】【画面描述】【口播文案】四要素,口播文案单句≤12字,禁用‘首先、其次’等书面连接词。”
点击生成后,检查输出是否含明确镜号与对应画面动线。若缺失“镜头角度”或“构图占比”,说明提示词中【景别+构图+时长】三项缺一不可,需补全重试。
第二步:人工校准口播文案的呼吸感与平台适配性
把AI生成的口播文案逐句读出来,删掉所有“这是因为”“由此可见”“综上所述”类书面表达。
把“该遮瑕膏具有优异的持妆能力”改成“这个膏一拍就融,蹭不花!”——口语化不是加语气词,而是用动词+短句制造节奏感。
检查是否含平台违禁词:“最”“第一”“根治”“绝对”全部替换。例如“遮瑕效果最好”→“很多姐妹说遮得匀、不卡纹”。
确认每句口播时长匹配对应镜头:第②镜演示动作共8秒,口播文案总字数不能超过28字(按中文平均语速3.5字/秒计算),否则剪辑时必然卡顿。
第三步:导出分镜表并转为AI生图提示词
将校准后的分镜表复制到Excel,按列整理为:镜号|时长|画面描述|口播|景别|运镜|光影。
取第①镜画面描述:“超近景,黑眼圈与健康肤色强烈对比,毛孔可见,纯白背景,顶部留白15%”,删掉中文标点,用英文逗号分隔关键词,补上模型识别强项词: ultra close-up, dark circle under eye vs smooth skin, visible pores, pure white background, top 15% empty space, studio lighting, sharp focus, 8k。
这串文字可直接粘贴进即梦、可灵等AI生图工具,生成精准参考图。注意【纯白背景】必须写明,否则AI默认添加杂乱环境,导致后续抠像失败。











