runway act-two可基于手机拍摄的半身视频,无需动捕设备即可复刻用户表情、肢体及手指动作;需企业或cpp账户权限,上传驱动视频与角色参考图后,调节表情强度与手势开关即可生成同步音频的mp4结果。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

想让一张角色图或一段角色视频,完全复刻你本人的说话表情、肢体动作甚至手指微动,不需要动捕服、红外相机或专业场地,只要一段手机拍的半身表演视频就能实现——这就是Runway Act-Two的核心能力。
确认权限与入口
登录 Runway 官网(https://app.runwayml.com/login),确保账户已开通 Gen-4 视频模型权限;Act-Two 目前仅向企业用户及 CPP 计划用户开放,普通免费账户无法看到该功能图标。
进入工作区后,在左侧工具栏底部找到 【Act-Two 图标】(图标为两个重叠的人形剪影),点击即可进入操作界面。若未显示,请检查右上角账户类型是否标注“CPP”或“Enterprise”。
准备并上传驱动视频
方法一:直接录制
点击界面左上方“Record”按钮,允许网页访问摄像头和麦克风,保持面部清晰、上半身入镜、背景简洁,录制一段 3~8 秒的自然表演(建议包含眨眼、转头、抬手、说话等动作)。
方法二:上传本地视频
将手机拍摄的 MP4 文件拖拽至提示画布中央,或点击“Upload video”选择文件;【视频必须为单一视角、正面或微侧角度、人物居中且占据画面 50% 以上】,否则面部对齐失败率极高。
注意:不要用剪辑软件裁切或加滤镜,原始帧率(30fps)和分辨率(1080p 优先)最稳定;压缩过度会导致手势识别失准。
添加角色参考输入
第一步:点击画布下方“Add character reference”区域
第二步:从本地选择一张高清角色图(PNG/JPEG),或拖入一段角色动画视频(MP4)
第三步:确保角色图中人脸朝向与驱动视频基本一致(例如都正对镜头),且脸部无遮挡、无严重阴影
关键细节:如果参考图是卡通/动物/非人类角色,无需调整比例或预处理——Act-Two 内置跨风格适配器,能自动匹配骨骼与表皮形变逻辑。
若使用视频作为角色参考,系统将默认取第一帧为静态锚点;此时驱动视频中的人物动作会完整迁移到该帧角色身上,生成全新动画序列。
调节表现力与启用手势
拖动“Facial Expressiveness”滑块控制表情强度:0.0 为最小幅度(适合严肃播报),1.0 为最大还原(适合喜剧表演),中间值 0.6~0.8 通常最自然。
手势捕捉默认开启,但需满足一个前提:【驱动视频中双手必须清晰可见且处于画面内】;若手部被桌面、衣袖遮挡,或超出画面边界,手势将丢失或错位到肩部。
关闭手势只需将“Hand Tracking”开关拨至 OFF——适用于仅需口型+微表情的配音场景,可显著缩短生成时间。
启动生成并下载结果
检查所有输入无误后,点击右下角绿色“Generate”按钮;生成耗时约 60~150 秒,取决于视频长度与服务器负载。
生成完成后,预览窗口自动播放结果,支持逐帧拖动查看;点击右上角“Download”图标,保存为 MP4 文件(含音频同步)。











