用度加ai克隆声音只需10秒清晰人声,可生成高度还原音色、语调和说话习惯的语音模型,支持短视频口播、有声书旁白及车载导航;需在安静环境录普通话整句,避免杂音与压缩音频;可通过官网或微信小程序上传/录制音频建模,再输入文本调节参数生成并下载mp3。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

用度加AI克隆声音,只需一段10秒左右的清晰人声,就能生成高度还原你音色、语调和说话习惯的语音模型,后续输入文字即可自动朗读,适合做短视频口播、有声书旁白或车载导航语音。
准备高质量10秒录音样本
打开手机自带录音机或微信语音输入,找一个安静无回声的房间,用普通话自然说出一句完整的话,比如“今天我要去超市买水果”,时长控制在9–12秒之间。避免咳嗽、翻页、键盘敲击等杂音,也【不要使用带背景音乐的视频原声或通话录音】——这类音频含混响和压缩失真,会导致克隆后声音发闷或断续。
录完立刻回听:人声是否饱满、字字清晰、语速平稳?如果某句有吞音或环境风噪,重录一遍比后期补救更省时间。
在度加AI网页端上传并生成音色
方法一:网页直接操作
① 用Chrome或Edge浏览器访问度加AI官网(dujia.baidu.com),登录百度账号;
② 进入「智能配音」→「我的音色」→「新建音色」;
③ 点击「上传音频」,选择刚录好的WAV或MP3文件(最大支持50MB);
④ 勾选「启用情绪识别」(可选),点击「开始训练」,等待约45秒,系统自动完成建模。
方法二:微信小程序快捷通道
微信搜索「度加AI」小程序→首页点击「克隆我的声音」→允许麦克风权限→按提示朗读屏幕上的三句话(共约10秒)→提交后60秒内生成音色,无需手动上传文件。
用克隆音色生成语音并导出
在「文本配音」页面,粘贴任意文案,例如“前方200米请左转,注意避让行人”,从音色列表中选择刚创建的名称,点击「生成语音」。
生成后可实时调节语速(-30%~+50%)、停顿(句间/词间可独立设毫秒值)、基础音调(±2个半音)。点击「试听」确认自然度,满意后直接点击「下载MP3」——文件名自动带时间戳,保存到手机相册或电脑本地均可。











