要在runway中保持ai生成视频中人物形象与动作稳定,需严格使用四角度2k参考图并正确上传至reference image栏、启用0.7–0.85强度的reference guidance;动作描述须绑定空间坐标,配合motion brush精准控制运动区域;口型同步需上传44.1khz单声道音频并在提示词中指定唇形触发指令。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

要在Runway里让AI生成的视频中人物始终长一个样、动作不跑偏,关键不是堆提示词,而是用对参考图和动作描述的组合方式——图决定“是谁”,动作描述决定“怎么动”,两者错位或缺一,角色立刻变形。
上传角色参考图的硬性要求
第一步:必须用一张【2K分辨率、正面+左右侧脸+四分之三侧面四合一】的拼贴图,不能是单张正面照,也不能是手机随手拍的生活照。Runway的Gen-4.5模型靠多角度像素对齐来建立人脸三维锚点,只给正面,它会在转头时捏出另一张脸。
第二步:把这张图上传到Image-to-Video工作流的“Reference Image”栏,不是丢进提示词框里写“参考这张图”。上传位置错了,整个一致性流程就失效。
第三步:在右侧参数面板勾选“Enable Reference Guidance”,再把强度拉到0.7–0.85区间。低于0.6,模型会忽略细节;高于0.9,动作僵硬、口型卡顿,尤其说话镜头容易嘴部糊成一团。
动作描述必须绑定空间坐标
方法一:用“@角色名 + 动作 + 空间锚点”结构写提示词。例如:@hero raises right hand → points to left-top corner of frame → steps forward 20cm。这里的“left-top corner”和“20cm”不是比喻,是Runway Gen-4.5能解析的真实空间单位,缺了坐标,动作就会漂移或缩放失衡。
方法二:配合Motion Brush手动圈出运动区域。比如要让人物挥手,先用笔刷涂满整条手臂,再拖动Horizontal滑块设为+35(向右甩臂),Vertical设为-12(向下收势)。【注意:千万别涂到肩膀以上区域,否则模型会误判为头部转动,导致五官错位】
方法三:对复杂动作,拆解成两段提示词分两次生成。先用“@hero stands still, eyes open, breathing naturally”锁定基础姿态,生成首帧;再在此帧基础上叠加“@hero lifts knee → rotates hip → swings arm in arc”,用首尾帧插值补中间动作。这样比一句写完所有动作稳定得多。
声音与口型同步的隐藏开关
第一步:上传一段本人真实说话的3秒音频(采样率44.1kHz,单声道),和角色参考图一起提交。
第二步:在提示词末尾加一句“mouth sync with audio waveform, teeth visible on ‘t’ and ‘p’ sounds”,这句触发Runway内部的唇形解码器,否则即使有音频,嘴型也只会机械开合。
第三步:生成后检查第12帧和第28帧的门牙边缘——如果两帧牙齿轮廓偏差超过3像素,说明音频波形没对齐,需用Audacity把音频开头静音部分裁掉50ms再重传。











