百度一镜数字人5分钟克隆需用自然光下横屏录制30~45秒正脸视频及同源降噪wav音频,避开光线暗、侧脸遮挡、背景杂乱;上传后双通道建模,完成即显“已就绪”,支持预览、导出样片和直播推流测试。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

想用百度一镜数字人快速克隆自己的声音和形象,不用买设备、不用租影棚,只要一段清晰视频+一段干净语音,5分钟内就能生成专属数字分身——但上传前必须避开光线过暗、侧脸遮挡、背景杂乱这三类废片,否则克隆失败率超70%。
准备拍摄素材
打开手机前置摄像头,在自然光充足的室内角落,用横屏录制一段30~45秒的真人说话视频:内容为自我介绍(如“大家好,我是XXX,今天来聊聊……”),语速平稳、口型清晰、全程正脸无遮挡。注意不要戴口罩、墨镜或大幅晃动手机。
同步录一段同源音频:直接从刚才视频里截取30秒原声,用手机自带录音软件另存为WAV格式;【务必用Audacity或剪映做一次降噪处理,否则AI会把空调声、键盘敲击声也学进音色里】。
检查画面是否满足三个硬指标:①人脸占画面1/2以上 ②双眼全程可见无闭眼 ③肩部以上完整入镜无裁切。
上传并启动克隆
进入百度慧播星官网 → 登录账号 → 点击「真人一键克隆」→ 选择「声音+形象联合克隆」→ 上传刚处理好的视频文件(MP4/MOV,≤500MB)→ 再上传降噪后的WAV音频 → 点击「开始训练」。
百度热榜监控 | Baidu Hot Topics Monitor. 获取百度热搜榜、搜索趋势、关键词热度 | Get Baidu trending searches, trends, keyword popularity. 触发词:百度、热搜、baidu.
系统自动进入双通道建模:形象模型基于视频帧提取面部纹理与微表情,声音模型则用电商大模型对齐语调节奏。整个过程约4分30秒,期间页面不刷新、不弹窗、不需手动干预。
收到短信通知后,返回控制台点击「我的数字人」即可查看克隆完成状态,头像右下角显示绿色“已就绪”标识即表示可用。
验证与调试效果
方法一:在「预览与调试」界面输入任意文案(如“今天天气不错”),点击播放按钮,观察嘴型同步度与音色自然度。若出现口型延迟或音色发虚,说明原始视频存在抖动或音频有回声,需重新上传。
方法二:点击「导出测试视频」生成3秒样片,下载到本地用VLC播放器全屏观看——重点检查眼角皱纹、嘴角弧度是否与本人一致,这是判断克隆精度最直观的指标。
方法三:切换至「直播推流测试」模式,用OBS接入RTMP地址,实时查看数字人在1080p画质下的肢体协调性。注意:首次推流前必须开启浏览器图形加速功能,否则画面会卡顿或黑屏。










