必须上传5–7张结构化多图并启用q2多图参考机制,包括正面全身、左右45°半身、正脸特写、服装及道具细节图,背景纯白、光照均匀、分辨率≥1024×1024,标注精准锚点且手动开启多视角校准,命名含不可替换视觉关键词,提示词开头调用主体名并避免重复外貌描述。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

要用Vidu生成同一角色在多个镜头中保持外观高度一致的视频,必须避免单图参考导致的视角失真或动态变形,核心在于上传结构化多图并启用Q2多图参考生视频机制。
准备符合要求的多张参考图
角色一致性崩溃的根源,往往始于第一张图就不达标。你不能随便截一张模糊侧脸或带反光的眼镜照就上传——系统会把噪声当特征学进去。
拍/选5–7张图:正面全身+左45°半身+右45°半身+正脸特写+服装细节(如领口刺绣、皮带扣)+道具特写(如角色常握的钢笔、背包挂饰)。所有图必须背景纯白或浅灰、光照均匀、人脸无遮挡、分辨率≥1024×1024。
特别注意:若角色戴眼镜、有明显痣或疤痕,必须在正脸图中清晰呈现;若穿复杂纹样服装,需单独上传高清纹理图,否则模型会把花纹识别成噪点而非风格锚点。
上传至主体库并启用多视角校准
登录 vidu.studio → 点击右上角「主体库」→ 「创建主体」→ 拖入全部参考图。
上传完成后,系统自动进入标注阶段;此时务必点击每张图右侧「编辑锚点」,用矩形框精准圈出你要锁定的区域——比如只框选正脸图中的双眼与鼻梁,不包含发际线以外的头发;只框选服装图中的袖口褶皱,避开背景干扰。
【启用多视角校准开关必须手动勾选】,该选项默认关闭。不勾选时,系统仅将多图当作冗余输入,仍按单图逻辑建模,跨角度一致性毫无提升。
命名时加入不可替换的视觉关键词,例如“银发狼耳少女-黑皮衣-左眼机械义体”,避免使用“主角A”“女主1”等模糊代称。
调用主体生成视频
进入「创作视频」→ 选择模型为 Vidu Q2 → 切换至「参考生视频」模式 → 在提示词开头直接输入@银发狼耳少女-黑皮衣-左眼机械义体。
后续描述只写动作与场景,例如:“疾跑穿过雨夜东京巷道,左手甩开伞,右耳狼毛被风掀动,霓虹倒影在积水路面拉长”。
禁止在提示词中重复描写外貌,如“银色长发”“黑色皮衣”“机械义眼”——这些已由主体库固化,重复输入反而触发冲突权重,导致局部崩坏。
生成前确认参数:关闭「真实感增强」「HDR渲染」;开启「关键帧对齐」与「运动连贯增强」;视频时长建议≤15秒,过长易引发结构漂移。











