必须统一所有参考图的构图比例与主体占比,否则会导致人物扭曲、动作抽搐、场景崩坏;需严格匹配宽高比,按用途选用9:16、4:3或1:1等基准比例,并可通过框选局部区域规避比例干扰。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

要让可灵AI多图参考生成的视频人物不扭曲、动作不抽搐、场景不崩坏,必须统一所有参考图的构图比例与主体占比——比例混乱会导致模型误判空间关系,把人脸拉长、把产品压扁、把背景错位拼接。
第一步:确认每张图的原始比例是否一致
打开每张参考图,在电脑上右键→“属性”→查看“尺寸”数值;所有图的宽高比必须严格匹配,例如全部是4:3(1920×1440)、全部是1:1(1080×1080)或全部是9:16(1080×1920)。【哪怕只有一张图是16:9,其余三张是1:1,AI也会在帧间切换时突然拉伸人物腰部】。
手机截图或微信转发过的图,常被自动裁切为竖版,但实际像素仍是横版残留,这种图表面看着像9:16,实则边缘有黑边或压缩伪影,必须用画图工具裁掉黑边再保存。
第二步:按用途选基准比例
方法一:做人物短视频(如口播、穿搭、剧情)→统一用9:16竖屏比例。上传前用Photoshop或免费工具(如Pixlr)将所有人像图裁为1080×1920,确保脸部居中、肩线完整、头顶与下巴留白均衡——AI会以这张图的构图锚定全身比例,偏移超15%就会导致走路同手同脚。
方法二:做产品展示/静物运镜→统一用4:3或1:1。1:1适合旋转展示(如手表表盘、首饰特写),4:3更适合桌面场景(如咖啡杯+托盘+背景书架),能保留左右环境信息,避免AI凭空补全错误纹理。
方法三:做分镜脚本/多角色互动→统一用16:9。仅限需要横向调度的镜头,比如两人并肩行走、对话站位、车窗外掠过风景等;但必须确保每张图的人物视线方向、光照角度、地面水平线高度误差≤3°,否则生成后会出现一人抬头一人低头的诡异错位。
第三步:局部参考时绕过比例陷阱
如果你只想让AI参考某张图的脸部、某件衣服的纹理或某个logo的位置,不用强求整图比例一致。进入多图参考界面后,上传所有图→点击任一图右下角的“框选”图标→用鼠标精准圈出你要锁定的区域(比如只框住眼睛+鼻梁+嘴唇)→松手后系统自动提取该区域特征并屏蔽其余部分。这一步能彻底规避因背景比例不一导致的肢体变形。
注意:框选后务必点击“确认局部”按钮,否则AI仍会读取整张图;未确认状态下生成的视频,局部细节会模糊且重复出现无关图案。











