必须先完成音色克隆才能启用情绪化配音:上传30~50秒降噪音频→命名并克隆音色;未克隆则视频合成页无“情感模式”选项;启用后可句级调节情感强度、语速、音调,或插入标准emotion标签;试听验证后导出需勾选“保留情感元数据”。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

要在百度一镜数字人中为生成的视频添加情绪化配音,必须先完成音色克隆并进入配音参数调节环节,否则无法启用情感控制开关。
完成基础音色克隆
进入百度智能云数字员工开放平台→点击「配置中心」→下拉选择「配置台」→点击「音色定制」→上传一段30~50秒、降噪处理后的原声音频(建议避开气口和“嗯”“啊”等语气词)→填写音色名称与性别→点击「开始克隆」。
这一步不可跳过。未完成音色克隆的账号,在后续视频合成界面将【看不到“情感模式”选项】,所有情绪参数均呈灰色禁用状态。
在视频合成页启用句级情感控制
方法一:使用已训练完成的音色合成视频时,在「声音设置」区域勾选「启用情感合成」→下拉选择预设情绪类型(如“亲切”“坚定”“兴奋”“沉稳”)→对每句话手动点击右侧「编辑」图标→在弹出面板中单独调整该句的情感强度(0~100)、语速(-30%~+30%)、音调(-200Hz~+200Hz)。
方法二:若需批量控制,可在文本输入框中直接插入情感标记语法,例如:
“今天要开会
系统识别到
验证并导出带情绪的语音
第一步:点击「试听」按钮,播放整段合成语音,重点听转折句、感叹词、结尾升调处的情绪响应是否自然;
第二步:若某句情绪偏弱,返回上一步,将该句的情感强度从60调至85再试听;
第三步:确认无误后点击「导出MP3」→勾选「保留情感元数据」→下载文件。
不勾选「保留情感元数据」会导致导出的音频失去可编辑性,后续无法在百度生态内重新加载情绪参数。











