企业需批量生成数字人视频以支撑日均50+条投放,前提是在百度一镜完成形象与声音克隆并确认“已就绪”;准备三列结构化csv文案(切入点、核心卖点、转化指令),上传后配置1080p画质、纯色渐变背景、智能断句字幕,关闭自动bgm,最后打包下载编号mp4文件直投广告平台。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

企业需要在信息流广告、短视频平台、私域社群中高频更新数字人视频素材,靠单条手动制作无法支撑日均50+条的投放测试需求,必须走批量生成路径。
确认前置条件:完成形象与声音克隆
批量生成视频的前提是已有可复用的数字人资产——必须先完成百度一镜平台上的【形象克隆】和【声音克隆】两项基础服务开通并训练完成。未克隆的公共库形象不支持情感模式切换与文案批量注入,生成结果将受限于平台预设模板,无法满足个性化脚本适配要求。
进入「我的数字人」列表,确认目标形象状态为“已就绪”,且对应的声音模型显示“训练完成”并支持“情绪调节”开关。
准备结构化文案矩阵
打开Excel或CSV文件,按三列组织数据:第一列“切入点”(如养宠家庭/职场妈妈/学生党),第二列“核心卖点”(如30天无理由退换/120℃高温除螨/APP远程控制),第三列“转化指令”(立即下单/点击领取/评论区扣1)。每行构成一条独立脚本,最多支持3000字/条,单次上传上限为100条。
注意:字段间用英文逗号分隔,首行必须为表头,禁止空行、合并单元格或特殊符号(如★、※、①);含中文标点的文案需确保UTF-8编码,否则导入后会出现乱码导致渲染失败。
这一步操作起来很简单,直接把整理好的CSV文件拖进百度一镜后台「批量脚本导入」区域即可。
配置批量生成任务
第一步:在「数字人视频」→「批量生成」页面,点击「新建任务」;
第二步:从下拉菜单选择已克隆的数字人形象;
第三步:绑定对应的声音模型,并开启「情感模式」开关——勾选后系统会自动为每条文案匹配适配语气(如促销类用兴奋语调、知识类用沉稳语调);
第四步:上传前述CSV文件,系统即时解析并显示待生成条数;
第五步:设置输出参数:画质选1080P(4K渲染耗时翻倍且对信息流投放无实质增益)、背景选「纯色渐变」(避免虚拟场景加载延迟影响批量吞吐)、字幕开启「智能断句」(防止长句挤出画面)。
关键提醒:若勾选「自动添加BGM」,系统将统一插入平台默认音效,无法按脚本情绪差异化匹配,建议关闭此项,后期用剪辑工具统一批量加音效更可控。
启动渲染并下载成品
点击「开始批量生成」按钮,后台显示实时进度条与预计剩余时间(通常100条1080P视频约需12~18分钟);
生成完成后,列表中每条记录旁出现绿色「下载」图标;
支持单条点击下载MP4,也支持勾选全部→「打包下载ZIP」一次性获取所有成片。
下载包内文件按原始CSV顺序编号命名(如001.mp4、002.mp4),无需手动重命名即可直连程序化广告平台素材库。











