ai短视频需规范参考图管理:人物图须按三视图(正面、左侧45°、背面)分角色建文件夹、裁切正方形、禁美颜hdr;场景图分全景、道具、光影三层上传;上传须严格按人物→全景→道具/光影顺序完成绑定校验。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

制作AI短视频时,人物和场景参考图一旦混乱,后续所有镜头都会出现角色变脸、空间错位、风格割裂的问题。你上传10张图,AI却只认其中3张;同一角色的正面照和侧脸照被当成两个人;咖啡馆全景图和吧台特写图被拆开理解——这些不是模型故障,是参考图管理没做对。
人物参考图必须按三视图结构整理
第一步:为每个主要角色单独建一个文件夹,命名格式为【角色名_编号】,例如“林小雨_01”。
第二步:每套人物参考图严格限定3张,且必须是同一角色的【正面、左侧45°、背面】三张标准角度照片,不能用自拍合照、生活抓拍或不同打光下的照片混搭。
第三步:三张图统一裁切为正方形,人物居中,头部占画面高度60%~70%,背景尽量纯色或虚化。如果用手机拍摄,务必关闭美颜和HDR——这两项会干扰AI对五官结构的识别。
第四步:在可灵AI上传时,选择“多图参考”模式,一次性勾选这3张图,并在提示词末尾明确写入:“以三视图为基准,禁止漂移,禁止添加新配饰或改变发型轮廓”。
场景参考图要分层打包,不能堆在一起
场景图不是越多越好。一张全景图+一张关键道具图+一张光影参考图,比10张随意截图更有效。
方法一:全景图定空间关系
选一张能看清房间四壁、门窗位置、主光源方向的广角图,作为场景锚点。这张图必须包含完整地面与天花板,不能是仰拍或俯拍畸变严重的照片。
方法二:道具图锁细节特征
比如咖啡馆场景,再上传一张吧台特写图,重点展示木质纹理、咖啡机型号、菜单板样式。这张图不用全貌,但必须清晰到能分辨材质与文字内容。
方法三:光影图控氛围基调
另存一张仅显示窗边光斑、桌面反光、阴影长度的照片。这张图不带人物、不带文字,只保留明暗过渡节奏。上传时勾选“仅作光影参考”,避免AI误把它当主体生成。
注意:三类图必须分开上传,不能合并成一张拼图,也不能压缩进ZIP包——可灵AI目前不解析压缩包内的图片层级。
上传前做一次“角色-场景绑定校验”
① 打开可灵AI创作页,进入“多图参考”上传区。
② 先上传人物三视图,等待系统识别出“主体A”并打上标签。
③ 再上传场景全景图,观察是否自动关联到“主体A”的空间坐标(界面右上角会出现“已绑定场景”提示)。
④ 最后上传道具图与光影图,确认它们下方都显示“辅助参考”,而非独立主体。
⑤ 若任意一步未出现绑定提示,立即删除全部重传,顺序不能颠倒。
这一步漏掉,后续生成的所有镜头里,角色会站在错误比例的空间中,比如人比门高两倍,或咖啡杯悬浮在半空。











