必须上传2–4张语义连贯、主体一致、光照统一、居中构图的1024×1024 jpg/png图,图1为清晰正面半身像,图2补45°侧脸,图3补背面或微仰视角,图4可选局部特写,禁用滤镜美颜,按命名顺序上传。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

准备可灵AI多图参考素材的核心要求
你要让可灵AI准确还原角色五官、动作逻辑和空间姿态,就必须提供一组语义连贯、结构互补的图像,不能随便找几张相似图就上传——图1拍得模糊、图2背景杂乱、图3主体只露半张脸,系统会直接丢失关键锚点,生成结果必然脸型错位或肢体断裂。
选图数量与格式硬性规定
必须上传2–4张图片,少于2张无法触发多图参考模式,超过4张系统自动截断只读前4张。
JPG或PNG格式,每张短边不低于300像素,但【强烈推荐统一为1024×1024分辨率】——尺寸不一致会导致模型在对齐不同图的面部比例时产生计算偏移,尤其影响侧脸与正面图之间的三维映射精度。
主体一致性实操要点
所有图片必须聚焦同一人或物,禁止混入不同个体、不同服装、不同妆容的图。哪怕只是换了一副眼镜,AI也会当作两个独立角色处理。
光照方向需基本一致:若图1是正午顶光,图2是黄昏侧逆光,模型将无法判断阴影走向,生成视频中会出现同一帧里人物左脸亮右脸黑的穿帮现象。
主体在画面中位置尽量居中,避免图1主体偏左、图2主体贴右边缘——这会干扰模型对空间坐标的统一建模,导致转身动作时身体突然“跳位”。
角度与姿态搭配策略
第一步:确定主视角图(图1)→ 选一张清晰正面半身像,确保双眼、鼻尖、嘴角完整可见,无遮挡无反光。
第二步:补足结构维度 → 图2用45°侧脸照体现颧骨高度与下颌线弧度;图3用背面或微仰视角展示肩颈线条与发际线走向;图4可选拍手部、脚部或标志性配饰特写(如耳钉、腰带扣),用于强化局部特征记忆。
注意:不要上传两张都是正面但表情差异极大的图(比如一张微笑一张皱眉),微表情冲突会让模型在生成中间帧时出现面部肌肉抽搐式抖动。
上传前最后三步校验
检查每张图是否能单独识别出主体轮廓——把图放大到200%,用手指盖住背景,只留主体,仍能一眼认出是谁/是什么。
关闭手机原生滤镜、美颜、HDR自动增强,这些处理会破坏皮肤纹理与光影过渡的原始信息,导致生成肤色失真、发丝粘连。
将四张图按从主到辅顺序重命名为“图1_正面.jpg”“图2_侧脸.jpg”“图3_背面.jpg”“图4_手部.jpg”,上传时系统将严格按文件名排序编号,避免手动拖拽错乱。











