必须创建主体资产并用三维坐标锚点锁定角色特征,上传三张无滤镜正侧照片、提取音色、命名保存后,在提示词开头固定添加[character:名称],再以具体数字定义位置、角度、距离及环境变量,最后锁定24fps输出参数。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

想让可灵AI生成的多个视频里同一角色始终长一样、穿同一件衣服、连耳垂形状都不变,必须绕过模型默认的随机采样机制,用提示词把角色特征焊死在生成流程里。
用主体资产锚定角色核心特征
这一步是所有一致性的地基。不创建主体资产,后续所有提示词优化都是空中楼阁——模型每次都在重新“想象”这个角色,五官漂移、服装纹理跳变、发型粗细不一全是必然结果。
1、登录可灵AI Web端→点击左上角“资产”→“主体资产”→“新建资产”。
2、上传三张图:正面高清照(≥1024×1024)、左侧45度半身照、右侧45度半身照。三张图必须光照均匀、无遮挡、【禁用任何美颜滤镜或HDR合成】,否则系统提取的三维结构会带入虚假平滑,导致后续视频中皮肤质感失真、轮廓发虚。
3、勾选“启用多视角智能补全”,等待系统渲染出5组特征图并显示“已锁定基础体型”。此时若中途关闭页面,已计算进度不会保存,需重头上传。
4、上传一段3秒以上、无背景音的清晰语音,点击“提取音色特征”。声纹ID一旦生成即绑定该资产,不可更改。
5、填写中文名称(如“灰袍老者”)与简要描述(如“左眉断痕,右手戴铜戒,拄乌木杖”),点击“保存为成熟主体”。
6、此后所有视频任务的提示词开头,必须固定添加[character:灰袍老者]。漏掉方括号、拼错名称、或放在提示词中间,均会导致调用失败。
提示词必须带三维坐标锚点
只写“灰袍老者站在窗边”远远不够。可灵AI对空间语义极其敏感,没有坐标约束的动作和位置描述,会在帧间产生毫米级偏移,累积到第3秒就出现衣摆错位、袖口高度不一等肉眼可见的断裂感。
方法一:在主体后立即插入定位短语
例如:“灰袍老者[character:灰袍老者]→双脚投影中心距画面底边38%高度,肩线平行于画面上边缘,视线落点位于水平中线偏右9%处→左手扶窗框,食指第二指节正对窗棂木纹接缝”。
方法二:用时间戳绑定关键帧姿态
例如:“第0.4秒:右膝屈曲22°,重心偏左腿,腰椎向右微旋3°;第1.1秒:左手腕背屈18°,铜戒反光点位于右眼瞳孔水平延长线向右7像素处”。
注意:所有角度、距离、像素值都必须是具体数字。写“微微弯曲”“稍微偏右”会被模型当作无效噪声过滤掉。
环境与动作必须冻结变量
角色一致≠整段视频稳定。如果背景在动、光影在变、镜头在抖,人再稳也会被带偏。可灵AI会优先响应变化最剧烈的元素,环境扰动会反向污染角色建模。
第一步:环境冻结
写“背景为青砖墙”不如写“背景青砖墙(无风化剥落,砖缝宽度恒定2.3mm,无新增阴影移动)”。括号内限定越硬,墙面纹理在5秒内越不会随帧跳变。
第二步:动作绑定参照物
不写“挥手”,写“右手抬起至与左肩齐平,指尖距左耳垂垂直投影点横向偏移15厘米,掌心朝前,拇指与食指呈15°夹角”。可灵对空间坐标系的响应精度远高于对动词的理解精度。
第三步:输出参数强制锁定
在提示词末尾加“以24fps恒定输出,无插值,首帧与末帧像素级对齐”。可灵不识别“慢动作”“升格”等影视术语,必须换算成帧率指令,否则默认启用AI补帧,导致关节运动粘滞或突兀加速。











