vidu q3及之后版本支持音频继承,需在参考生视频模式下开启【音频继承开关】;q1/q2不支持,强制上传会触发ai重配音。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你想用Vidu生成新视频但又不想丢掉原视频里的声音,比如保留采访原声、配音台词或环境音效,直接覆盖音频会毁掉关键信息,必须绕过默认的AI音效重生成机制。
确认模型是否支持音频保留
Vidu Q3及之后版本(含Q3 Pro、Q4内测版)在「参考生视频」模式下提供【音频继承开关】,位于参数设置页底部“高级选项”折叠栏中;Q1/Q2模型无此功能,强行上传带音视频的参考文件会自动触发AI重配音,无法规避。
打开Vidu官网→登录账号→进入「参考生视频」工作台→点击右上角“模型切换”→确认当前选中为“Vidu Q3”或更高版本。
上传参考素材并锁定音频源
第一步:点击“上传参考视频”按钮,选择你希望保留原声的那个5秒以内MP4/MOV文件(注意:时长超5秒将被自动截取前5秒,且仅前5秒音频可继承)。
第二步:上传完成后,页面右侧出现“音频轨道预览”,点击播放图标试听——若听到的是原声而非AI合成音,说明音频已识别成功;若听到机械感明显的AI配音,说明该文件编码不兼容(常见于手机录屏导出的HEVC+AAC组合),需用万兴优转→视频工具→“重新编码器”转为H.264+AAC封装后再上传。
第三步:勾选【继承原始音频轨道】复选框,此时下方“AI音效生成”滑块自动置灰不可调,表示系统已禁用语音/音效重生成模块。
输入提示词并控制画面生成范围
方法一:纯画面替换(推荐新手)
在提示词框中写明“保持原视频全部音频不变,仅重绘画面:[你的具体描述]”,例如:“保持原采访者说话原声不变,仅将背景从办公室替换成东京涩谷十字路口夜景,人物服装同步更新为商务休闲装”。
方法二:局部动作迁移(需精准控制)
上传两个参考视频:第一个是带原声的目标视频,第二个是纯动作参考(无声)。在提示词中强调“动作仅从第二视频提取,画面风格与第一视频一致,音频完全继承第一视频”。【注意:两段视频时长必须严格一致,否则音频错位无法修正】
提交生成后,等待Q3模型完成16秒直出——最终结果为:原有时长的视频画面全新生成,原音频毫秒级对齐,无任何淡入淡出或时间偏移。











