百度一镜数字人支持ai自动配音,需通过官方平台上传mp4格式、720p以上、时长≤5分钟的原始视频,启用「ai驱动型」项目并勾选「启用ai自动配音」,选择音色或粘贴中文简体脚本,再调节语速(0.9~1.1)和停顿后应用重生成。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

百度一镜数字人支持AI自动配音,但必须通过官方平台上传视频并启用语音合成服务,本地文件无法直接调用其TTS引擎。
准备符合要求的原始视频
确保视频为MP4格式、分辨率不低于720p、时长不超过5分钟,且画面中人物口型清晰、无遮挡。若视频含背景音乐或多人对话,AI配音将无法准确对齐口型,生成效果会明显失真。
导出前关闭所有降噪/美颜滤镜,保留原始人声轨道——即使你打算替换它,也需让系统识别说话节奏和停顿位置。
登录百度智能云控制台并进入一镜数字人工作区
访问yijing.baidu.com,使用百度账号登录,点击「数字人」→「一镜数字人」→「创建项目」。
新建项目时选择「AI驱动型」而非「模板驱动型」,否则后续无法开启自动配音功能。
上传视频并启用AI配音
方法一:拖拽上传视频文件 → 点击「下一步」→ 在「音色配置」页勾选「启用AI自动配音」→ 从下拉菜单中选择音色(如“晓辰-女声”“度小宇-男声”)→ 点击「确认配置」。
方法二:若已有脚本文本,可跳过语音识别环节,直接粘贴文字到「配音文本」框 → 系统将自动生成语音并驱动数字人口型同步。注意:【文本需为中文简体,每段不超过300字,标点须为全角】,否则合成失败率高。
这一步操作起来很简单,直接把文件拖进去就行。但千万别在未勾选「启用AI自动配音」的情况下点击「生成」,否则系统默认静音输出,且生成后不可回溯补配。
调整语速与停顿细节
第一步:生成预览后,点击右上角「编辑配音」按钮;
第二步:在波形图上拖动黄色标记点,手动延长句末停顿或压缩冗余气口;
第三步:调节「语速」滑块至0.9~1.1区间,超出范围会导致口型错位——实测1.2以上时下巴动作明显滞后于语音。
修改后必须点击「应用并重生成」,否则仅预览有效,导出仍是旧版本。











