必须用多图参考模式锁定人物三维结构,否则角色会“变脸”或肢体错位;需安装v3.0.2+客户端,按三视角或四图法准备1024×1024同人同装图片,图1必为正面,提示词须遵循“动词+部位+方向+节奏”结构,时长固定4秒。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

要用可灵AI生成角色稳定、动作连贯的短剧片段,必须用多图参考模式锁定人物三维结构,否则同一角色在不同镜头里会“变脸”甚至肢体错位——这不是参数调得不够细的问题,而是模型根本没获得足够空间锚点。
确认环境与入口
第一步:下载并安装电脑版可灵AI客户端,版本号必须为【v3.0.2或更高】;网页端和手机App完全不支持多图参考功能,强行上传只会提示“该模式不可用”。
第二步:启动软件后,点击左侧栏【视频生成】→顶部切换至【图生视频】→再点【多图参考】,此时界面右上角应显示“视频1.3模型已自动启用”。
准备参考图组
方法一:基础三视角法(推荐新手)
① 正面半身像(肩部以上清晰,无遮挡,光照均匀)
② 左侧45°全身照(能看清手臂比例与衣摆走向)
③ 背面轮廓图(突出肩线与发尾弧度,避免纯黑剪影)
三张图必须为同一人、同一服装、同一画风,且全部裁切为1024×1024像素——尺寸不一致会导致AI误判空间关系,生成时出现手长腿短或头身分离。
方法二:增强型四图法(适合复杂动作)
在三视角基础上,加一张手部特写(如握拳/摊开/持物),用于强化手势逻辑;这张图不必全身,但手指关节必须清晰可辨,模糊的手部会引发AI生成“多指”或“反关节弯曲”。
上传与编号
将准备好的2–4张图一次性拖入中央虚线区,系统会自动按上传顺序编号为图1→图4。注意:【图1必须是正面图】,这是AI构建初始人脸拓扑的关键锚点,若图1为侧脸,后续所有姿态都会发生系统性偏移。
上传完成后,界面左下角会显示“参考图加载完成”,右侧预览窗同步显示四宫格缩略图。若某张图显示为灰色占位符,说明格式非JPG/PNG或含Alpha通道,需用Photoshop另存为标准JPG再试。
写精准动作提示词
在提示词框中输入中文指令,严格遵循“动词+部位+方向+节奏”结构。例如:“女子左脚前迈半步→右臂自然垂落→头部微向右偏15度→裙摆随动轻扬”。
禁止使用任何模糊副词。“优雅转身”会被AI解析为随机骨骼扭曲;“大概抬手”会导致手臂悬浮或关节翻转。把“走路”拆解为“左脚 heel-strike → 承重转移 → 右膝微屈→右脚跟落地”,AI才能生成符合生物力学的帧序列。
时长固定设为4秒,多图参考模式暂不开放10秒选项——强行拉长会导致中间帧崩解,人物五官开始融化或背景出现重复纹理块。











