必须提前创建并调用主体才能保证角色视频连续多帧不“变脸”“换装”“错位”:上传三张1024×1024同人同装三视图→命名创建主体→文生视频中@调用→可选音色绑定与括号冻结关键部位。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

要用可灵AI生成连续多帧中完全不“变脸”、不“换装”、不“错位”的角色视频,必须把角色形象提前存为可调用的主体,否则每次生成都得重传图、重写描述、重调参数,稍有遗漏就会导致同一角色在不同镜头里变成另一个人。
创建主体:上传三视图并命名
打开电脑版可灵AI网页端或v3.0.2+客户端,点击左侧边栏【全部工具】→【图片/主体参考】,或直接悬停在【omni】图标上,点出【创建主体】。
点击界面中央空白处或【添加图片】,一次性上传3张1024×1024像素的同人同装图片:正面(肩部以上清晰无遮挡)、左侧45°全身(看清手臂比例与衣摆走向)、背面轮廓(突出肩线与发尾弧度,避免纯黑剪影)。
三张图尺寸不一致会导致AI误判空间关系,生成时出现手长腿短或头身分离——【必须全部裁切为1024×1024】。
输入主体名称(必填),选择分类(如人物选“角色”,动物选“动物”),名称未填或仅填名称但未再次上传图片,“创建”按钮始终为灰色不可点。
调用主体:在文生视频中@使用
进入【视频生成】→【文生视频】模式,光标定位到提示词输入框,直接输入@符号,下拉菜单中会出现你刚创建的主体名称,点击即可插入。
插入后,提示词开头自动变为“@你的主体名:”,后面接动作描述,例如:“@小满:抬右手轻撩额前碎发,嘴角微扬,背景为青砖庭院,晨光斜照”。
此时模型不再依赖文字描述五官/发型/服装,而是直接绑定主体库中的三维结构数据——即使提示词只写“她笑”,也不会变成另一个人的脸。
进阶控制:绑定音色与冻结关键部位
方法一:音色绑定(可选)
在创建主体时点击【音色】→上传一段3~5秒清晰人声录音(无背景音、无混响),后续文生视频中只要@该主体,配音就自动匹配此音色,无需额外选TTS。
方法二:肢体冻结(强推荐)
在文生视频提示词中,对易崩坏部位加括号锁定:“@小满(肩颈线水平,十指完整可见,指尖距裙缝线恒定2厘米,左眉上扬0.5毫米):缓步向前,裙摆飘动幅度不超过膝上15厘米”。
可灵对手部和微表情极度敏感,漏括号=多指/断指/手掌翻转;【所有织物类描述必须带飘动上限或静止约束】,否则默认启用流体模拟,5秒内必出现布料穿透肢体。











