必须通过主体库注册+@符号绑定+多视角校准三步闭环锁定视觉资产:先在vidu主体库上传5–7张标准化参考图并编辑关键锚点,命名体现核心识别项;生成时强制在提示词开头用@调用主体名;复杂动作启用q2多图参考生并开启一致性增强;复用理想帧需截取png格式峰值帧作跨视频参考源。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

要在Vidu中用参考图生成多段视频并确保角色、服装、道具、画风始终如一,必须绕过模型自由泛化机制,把视觉资产变成可调用、可锁定、可复用的数字身份——不是靠反复上传同一张图,而是靠主体库注册+@符号绑定+多视角校准三步闭环。
创建主体库并上传标准化参考图
主体库不是文件夹,是Vidu内部建立视觉ID的注册中心。上传即建模,不注册就无法跨会话调用,所有后续一致性都从这一步开始。
1、登录Vidu官网(https://www.vidu.studio/),点击右上角「主体库」→「创建主体」。
2、一次性上传5–7张图:正脸半身(双眼睁开、嘴唇微启)、左45°侧脸(清晰露出左耳与颧骨)、右45°侧脸(同理)、全身站姿、服装细节特写(如皮衣拉链、刺绣纹样)、道具特写(如吉他琴颈、耳环反光面)。所有图必须统一背景(纯白或浅灰)、相同光照方向、无美颜滤镜、分辨率≥1024×1024。
3、上传后系统自动标注关键区域;若某处特征易被忽略(如眉尾痣、袖口褶皱走向),点击该图右侧「编辑锚点」,用矩形框精准圈选并保存——【未框选关键细节的图,系统默认跳过该区域建模】。
4、命名时直接体现角色核心识别项,例如“红发双马尾-机械义眼-铆钉短裙”,避免用“女主1”“人物A”这类无意义代号。
用@符号调用主体生成首段视频
调用不是可选项,是强制锁定的唯一路径。不加@,哪怕上传了图,系统也只当普通参考图处理,特征权重不足,极易漂移。
方法一:文生视频中调用
在提示词开头直接输入@红发双马尾-机械义眼-铆钉短裙,再接动作描述,例如“单膝跪地调试左臂接口,右手指尖弹出蓝色数据流,背景为锈蚀管道”。
方法二:图生视频中调用
进入「参考生视频」模式,选择模型为Vidu Q3,不上传任何本地图,仅在提示词中写@红发双马尾-机械义眼-铆钉短裙 + 场景指令——【此时系统自动加载主体库全部锚点特征,全程禁用通用人脸模板】。
方法三:多角色同框调用
写“@红发双马尾-机械义眼-铆钉短裙 与 @银灰长发-光学镜片-高领风衣 并肩站立,前者左手搭后者右肩”,两个@之间不加顿号或连接词,模型才能识别为独立主体。
启用Q2多图参考生增强一致性
Vidu Q2支持最多7张图协同建模,不是简单叠加,而是让模型在空间向量场中对齐结构逻辑。适用于复杂动态(奔跑、转身、武器挥舞)和极端视角(俯拍、仰拍、背影)。
第一步:新建任务 → 选择模型为 Vidu Q2 参考生
第二步:勾选「启用多图参考生」开关 → 上传已注册主体的全部7张图(含首尾帧)
第三步:在提示词中保留@主体名,并追加运动约束,例如“@红发双马尾-机械义眼-铆钉短裙 缓步前行→左脚落地瞬间膝盖微屈→右臂自然摆动幅度≤15°→发尾飘动轨迹与地面平行”
第四步:开启「主体一致性增强」滑块至90%,关闭「写实增强」「HDR渲染」两项干扰项
复用理想帧作跨视频参考源
当某段生成视频中角色状态完美(表情自然、光影贴合、姿态协调),截取这一帧作为新视频的“像素级起点”,比重新上传原图更可靠——它已通过模型一次完整推理验证。
1、播放已完成视频,在第3秒或第7秒等动作峰值帧暂停(避开眨眼、嘴部开合瞬间)。
2、右键截图 → 保存为PNG格式 → 确保分辨率不低于720×1280,无压缩失真。
3、新建任务 → 进入「参考生视频」模式 → 点击「上传参考图」→ 选择该PNG → 提示词中写“保持与参考图完全一致,仅改变背景为霓虹雨夜街道”。
这一步操作起来很简单,直接把文件拖进去就行。但注意:不能用JPG格式,JPEG有损压缩会导致边缘锯齿,模型会误判为“破损皮肤纹理”而强行补全,引发五官偏移。











