vidu中需用三视图锚定骨骼、素描引导动作、手帧图固定构图、比例总览图约束尺寸,四步协同确保人物动作精准稳定。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

在Vidu中让参考资料真正驱动人物动作,不是上传完就结束,而是要让每张图承担明确角色——有的锁定体型,有的定义姿态,有的框定空间关系,否则模型会自行“脑补”导致动作失真、比例错乱或肢体漂移。
创建主体库:用三视图锚定骨骼基准
这一步是后续所有动作稳定的地基。只传一张正面照,模型无法推断转身时后脑勺的发旋位置或抬手时肩胛骨的转动角度,生成中必然出现背部塌陷、手臂穿模等崩坏现象。
1、准备三张图:正面全身照(纯色背景、无遮挡)、清晰侧身行走示意草图(标出重心线与膝关节弯曲方向)、背面半身照(重点展现发辫/披风/衣领结构)。
2、进入Vidu「主体库」→点击「新建主体」→依次上传三张图,系统自动识别并拼合为统一角色档案。
Vidu视频生成插件(viduq3-pro、viduq3-turbo、viduq2、viduq1)。支持文字转视频、图片转视频、参考转视频以及起始编辑。
3、上传后立即点击「预览骨骼绑定」,确认模型是否准确识别了肩宽、腰线、腿长比例。若肩部节点偏高或膝盖节点浮空,【必须删除重传,不可跳过校验】。
上传动作引导图:用素描替代文字描述
文字提示词如“自然摆臂”“轻微点头”对Vidu Q1模型响应率低于37%,而一张手绘侧身迈步素描图,能直接触发其运动先验模块,生成帧间连贯度提升2.3倍。
方法一:上传单张关键姿态图
- 绘制一张人物处于动作峰值的简笔画,例如右臂扬至45°、左膝屈曲90°、裙摆腾空离地约2cm;
- 在图上用矩形框【仅框选正在剧烈运动的袖口与裙摆区域】,避免框住静态躯干干扰模型对动力源的判断。
方法二:上传多相位锚点图序列
- 准备三张图:起始帧(右脚触地)、中间帧(双足离地腾空)、结束帧(左脚前迈落地);
- 上传时勾选「启用相位序列模式」,系统将按图序强制插值生成符合生物力学的步态曲线。
绑定构图手帧:把镜头和位置钉死
很多人生成后发现人物忽大忽小、忽左忽右,问题不在动作本身,而在模型对画面构图缺乏物理约束。手帧图就是给AI下的一道“铁律”。
第一步:拍摄或绘制一张你想要的最终成片构图图,要求包含人物、地面路径、远处参照物(如一棵树、一扇门),且人物处于动作中段姿态;
第二步:上传该图时,在右侧面板选择「作为手帧图(Composition Anchor)」;
第三步:在提示词中写入“严格匹配手帧图中人物与门框的比例关系,禁止缩放、旋转、平移人物整体”,模型将放弃自由发挥,转而以该图为唯一空间坐标原点进行渲染。
校正比例总览图:解决“人比楼高”类错误
当人物站在微缩城市或古建筑前却显得像巨人,不是模型理解错,而是它没收到任何关于“相对尺寸”的视觉信号。这时候需要一张人为绘制的总览图来喂给它。
① 打开绘图软件,新建画布,按真实比例绘制:一栋10米高的钟楼(画高10cm)、一个1.7米的人(画高1.7cm)、地面石板路(每块砖长0.6米→画长0.6cm);
② 确保所有元素在同一图层、无透明度、线条闭合;
③ 将该图命名为“比例总览.png”,上传时选择「启用比例约束模式」;
④ 提示词中必须出现具体数字:“人物身高1.7米,钟楼高度10米,人物站立位置距钟楼基座3.2米”,文字+图像双重锁定才能生效。










