anishort通过将人物作为数字资产绑定视觉与语音特征来固定造型。上传定妆图生成三视图并创建主体,再绑定人声音频实现唇形同步,分镜中调用主体时禁用外貌提示词以防止变形。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

在AniShort中固定人物造型的核心逻辑
AI短剧最怕角色跨镜变脸——女主第一集穿蓝裙扎马尾,第二集突然穿红裙披散长发,连耳垂形状都对不上。AniShort不靠“猜提示词”来稳住形象,而是把人物当作可复用的数字资产来管理,从创建那一刻起就绑定视觉特征与语音特征。
上传定妆图并生成三视图
打开AniShort官网(https://anishort.ai/),点击“开始创作”→新建项目→进入画布界面。
先别急着生成视频,点左上角“资产”→“人物”→“新建主体”,再点击“上传参考图”。这张图必须是正面、人脸占比超70%、无遮挡、纯色背景(推荐白底),否则后续三视图生成会漏掉关键结构线。
上传后,在提示框中输入精准描述:“15岁日本女学生,真人风格,左边大头照+右边三视图(正/侧/45°),无文字,背景纯白,保留原图发型与瞳色”。【必须勾选“人像写实”风格统一开关,否则左右两图会渲染成不同画风】
等待生成完成,右键点击新出的三视图→选择“创建主体”。这一步会把整套视觉特征打包进AniShort的角色资产库,后续所有分镜调用的都是这个包,不是临时拼凑的图。
绑定语音与面部关键点
人物光有脸还不够,嘴型要跟得上台词。点击顶部导航栏“声音”→“新建音频主体”→上传已提取的人声片段(务必提前用剪映或Audacity开启“仅保留人声”降噪)。
方法一:直接拖入已剪辑好的台词音频,系统自动识别语速与停顿点,匹配到当前人物主体的口型驱动模型。
一款AI工具,主要用于在主代理响应前,并行运行Kimi K2.5和GPT 5.3 Codex,注入双方观点以增强认知多样性,适合需要提升相关任务效率的用户。
方法二:若需更高精度,点击该音频主体右侧的“编辑绑定”,手动指定对应人物主体ID。此时AniShort会调用Seedance2.0的唇形-语音对齐引擎,逐帧校准开口幅度与音素节奏。
注意:如果上传的是带环境音的原片音频,生成的嘴型会严重错位,因为AI会把背景杂音也当成发音信号处理。
在分镜节点中锁定角色调用
进入剧本节点→点击任意分镜卡片→在右侧属性面板找到“角色”下拉菜单→选择你刚创建的主体名称(如“樱井美咲_v1”)。
第一步:确认“启用角色资产”开关已打开;
第二步:检查下方“姿态控制”是否启用ControlNet骨骼约束(默认开启);
第三步:在提示词框中只写动作与场景,例如“转身推门,雨夜街道,霓虹灯反射水洼”,【严禁重复粘贴外貌描述词,否则会触发AI二次想象,导致五官偏移】;
第四步:点击“生成画面”,系统将强制调用该主体的面部嵌入向量+服饰纹理+语音波形三重锚点,输出结果自动继承原始定妆图的所有结构特征。









