可灵ai生成视频需严格遵循“主体+动作+环境变化”三要素提示词结构,图片须清晰居中、格式jpg/png且≤5mb;动作描述须具体到部位、方向、幅度,镜头与光影提示须明确行为或变量,末尾加“--no watermark --s 800”可优化输出。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

用可灵AI将静态图片生成高质量视频时,提示词直接决定画面动态逻辑、主体行为连贯性与镜头表现力,写错一个关键词就可能让人物突然漂浮、背景错位或动作卡顿。
先确认图片基础质量
上传前检查原图是否清晰、主体居中、无大面积遮挡。模糊或严重倾斜的图会放大生成错误,可灵对低质输入没有容错机制。
确保图片格式为JPG或PNG,文件大小控制在5MB以内——超大会被系统自动压缩,导致细节丢失,影响提示词生效精度。
核心提示词结构:三要素缺一不可
可灵识别的是“主体+动作+环境变化”三层指令,必须同时存在,缺任何一层都会默认静止或乱动。
方法一:标准模板式写法
【主体】+【具体动作】+【镜头/光照/风格补充】
例:“一只橘猫蹲在窗台→缓缓转头看向窗外→阳光斜射,胶片质感,轻微镜头推进”
方法二:分句强调式写法
第一句锁定主体与初始状态:“年轻女性穿白衬衫坐在书桌前,手扶额头”;
第二句定义动态起点:“她忽然抬头,眼神聚焦”;
第三句控制空间逻辑:“书桌上的咖啡杯微微晃动,背景虚化缓慢后移”。
【注意:三句之间不能用分号或连接词,必须换行或用句号隔开,否则可灵会混淆主谓宾】
动作描述必须具体到帧级逻辑
第一步:拒绝抽象动词。删掉“优雅地”“慢慢地”“似乎要”,换成“手指逐根张开”“眼皮以0.3秒匀速抬起”“左肩先下沉15度再抬臂”。
第二步:绑定动作与身体部位。不写“他挥手”,写“右手肘固定,小臂从下向上挥至齐肩高,五指自然张开”。
第三步:限定运动方向与参照物。“头发向右飘动”无效,“发梢朝画面右侧偏移约20厘米,与窗外飘动的白色窗帘同频”才被准确解析。
这一步操作起来很简单,直接把改写后的动作短语粘贴进提示框就行。但若跳过部位+方向+幅度三重限定,生成结果90%会出现肢体扭曲或局部静止。
环境与镜头提示词避坑指南
写“电影感”“高清”“4K”完全无效,可灵不识别画质类形容词。
有效写法只两类:
① 镜头行为:“镜头从脚部仰角缓慢上移至面部”“主观视角,手持微抖”;
② 光影变量:“正午顶光渐变为黄昏侧光”“台灯暖光随人物转身同步移动”。
提示词末尾加“--no watermark --s 800”能强制关闭水印并提升采样步数,但【s值超过900会导致画面过曝且无法撤回】。











