可灵ai生成1分钟视频需用三段式提示词:第一步写主体+核心动作+场景(占40%字数);第二步用分号分隔2~3个含视角与时长暗示的连续镜头;第三步加风格与技术参数(如“无文字”必写)。关键靠动作数量(8~12个)、汉字书写时间(如“三秒”)、配音文本(120字内)锚定时长,禁用主观形容词和过渡词。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

用可灵AI生成1分钟视频时,提示词必须精准控制时长、节奏和画面连贯性,否则生成结果常卡在30秒就中断或人物动作突兀跳帧。可灵对时间描述不敏感,直接写“60秒”无效,需靠镜头数量、动作密度和语速反推时长。
基础结构:三段式提示词框架
第一步:写明主体+核心动作+场景,占总字数40%。例如:“一位穿浅蓝衬衫的亚洲女性,面带微笑,站在现代开放式厨房里,右手拿起不锈钢锅,左手打开燃气灶开关”。这一步漏掉“打开燃气灶开关”这个具体动作,AI会生成她举着锅静止不动的画面。
第二步:插入2~3个连续镜头切分点,用分号隔开。每个镜头含视角+持续时间暗示。例如:“中景→她倾斜锅倒入橄榄油;特写→油面泛起细小涟漪;全景→她用木铲翻炒彩椒丁”。这里【必须用中文顿号或分号分隔镜头,不能换行或加项目符号】,否则可灵会忽略切分逻辑。
第三步:结尾加风格与技术参数。写成“电影感自然光,8K超清,30fps,无文字,无logo,背景音为轻快尤克里里音乐”。若漏掉“无文字”,AI默认在画面底部叠加白色字体标题,且无法后期删除。
控制时长的关键技巧
方法一:用动作数量锚定时长。1分钟视频≈8~12个清晰动作单元。比如“取蛋→敲碗→打散→倒进锅→翻炒→装盘→摆上桌→微笑点头”,共8个动作,刚好撑满60秒。动作少于6个,视频大概率不足45秒。
方法二:在镜头描述里埋时间线索。写“缓慢推进镜头,持续3秒”比写“推进镜头”更有效;但注意【所有时间数字必须用汉字‘三秒’‘五秒’,写‘3s’或‘3秒’会被系统过滤】。
方法三:用语速反推。在提示词末尾加一句配音文本,长度控制在120字内。可灵会按此文本自动匹配口型和节奏,120字普通话朗读刚好55~62秒。例如:“今天教大家三分钟搞定快手早餐——先热锅冷油,再下蛋液,等边缘凝固立刻滑炒,最后撒点葱花,香气扑鼻!”
避坑:高频失效表述清单
删掉所有“高清”“高质量”“精美”这类主观形容词——可灵没有对应权重,纯占字数。
禁用“然后”“接着”“接下来”等过渡词,AI会当成新指令重复执行前一个动作。
避免写“观众视角”“第一人称”,可灵不识别视角代词,反而导致镜头混乱。
人物数量严格限定为1~2人。输入“一家人围坐餐桌”会触发人脸融合错误,生成五官错位的合成脸。











