度加ai图文视频需进入「智能创作」→「图文转视频」,关闭“智能构图”并勾选“保持原始比例”,上传编号图片后可选ai配音或按文案配音,导出前须校验画面、字幕与参数。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

想用度加AI把几张图变成带配音的抖音图文视频,但点开界面找不到入口、生成后语音卡顿、图片被自动裁切变形,不是你不会操作,是没对准2026年7月最新版度加AI的图文视频生成逻辑——它不叫“图文成片”,而藏在「智能创作」二级菜单里,且必须手动关闭“智能构图”才能保住原图比例。
打开度加AI并定位图文视频入口
访问度加AI官网(dujia.bytedance.com)→ 用抖音账号扫码登录 → 首页顶部导航栏点击「智能创作」→ 在下拉菜单中找到并点击「图文转视频」。
这一步不能点错成「AI成片」或「脚本生成」,那两个入口走的是文生视频路径,会忽略你上传的图片。
上传图片与设置基础参数
点击「上传图片」区域,拖入3~12张JPG/PNG格式图片(单张不超过10MB)。
【图片必须按播放顺序编号命名,如01.jpg、02.jpg……否则系统会打乱顺序】
勾选「保持原始比例」→ 关闭「智能构图」开关(默认开启,不开此开关会导致人物头像被切掉)→ 设置视频时长:每张图默认停留3秒,总时长=图片数×3,可手动微调单图停留时间。
生成配音的两种方法
方法一:AI自动配音(推荐新手)
点击「添加配音」→ 选择「AI配音」→ 在音色列表中选「温暖女声-03」或「沉稳男声-05」(这两个音色2026年7月实测口型同步率最高)→ 点击「生成配音」,等待8~12秒完成。
方法二:自定义文案配音(适合有脚本需求)
先点击「编辑文案」→ 为每张图输入对应旁白(例如第1张图填“清晨六点,老城区的青石板路泛着微光”)→ 返回配音页 → 选择同一音色 → 点击「按文案配音」→ 系统将严格按你写的字逐句合成,语速自动匹配字数。
注意:若文案含方言词或专有名词(如“厝边”“鲯鳅”),务必在文案后加括号注音,否则AI会读错。
导出前的关键校验步骤
第一步:预览全片 → 拖动时间轴检查每张图是否完整显示、配音是否卡在画面切换点。
第二步:点击「字幕设置」→ 开启「自动识别配音生成字幕」→ 字体选「思源黑体 Bold」→ 大小设为48 → 位置选「底部居中」。
第三步:点击「导出设置」→ 分辨率选「1080×1920」→ 帧率选「30fps」→ 码率选「8Mbps」→ 格式选「MP4」→ 最后点击「立即导出」。











