anishort不支持语音识别生成字幕,必须在分镜节点中手动添加带时间戳的台词(格式:|start:x.xs|end:y.ys),合成时选择硬字幕(burn-in)模式并设置合适字体参数。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

AniShort 本身不提供“语音识别→字幕生成→自动对齐→样式渲染”全链路一键字幕功能。所谓“一键添加”,实际是平台在合成环节调用内置字幕引擎,把已结构化的台词文本按时间轴硬编码进视频帧——前提是你的分镜节点里,每句台词都带准确起止时间戳。
为什么AniShort的字幕不能直接识别音频?
它默认跳过ASR(自动语音识别)环节,因为配音和视频是并行生成的:配音由Seedance2.0或Gemini在生成阶段就输出带时间码的.srt片段,视频节点会读取该时间码做硬字幕嵌入。如果你上传外部音频,平台无法自动匹配台词时间轴,字幕必然错位。
必须提前在分镜节点里写好带时间戳的台词
这是整个流程最关键的前置动作。很多用户卡在“点了字幕开关却没反应”,根本原因是分镜脚本里只写了台词:“你好”,没写台词:“你好”|start:0.5s|end:1.8s。
使用AIsa生成图像与视频。仅需一个API密钥即可调用Gemini 3 Pro Image(图像)和Qwen Wan 2.6(视频)。
- 在画布中双击任意分镜节点 → 进入「台词编辑器」
- 每句台词末尾手动追加时间标记,格式严格为
|start:X.Xs|end:Y.Ys,单位必须是秒,小数点后一位即可 - 时间戳要略宽于实际配音时长(建议前后各留0.2s余量),否则字幕会闪断
- 若使用
Ani智能体助手生成台词,需开启「带时间码」选项(默认关闭)
合成时启用硬字幕嵌入而非软字幕轨道
AniShort导出成片时提供两种字幕模式:硬字幕(Burn-in)和软字幕(SRT轨道)。短视频平台(抖音、快手)几乎不支持播放时加载外部.srt,必须选硬字幕。
- 进入「合成设置」面板 → 找到
字幕输出模式下拉菜单 - 明确选择
Burn-in(嵌入式),不是Embedded SRT或None -
字体大小建议设为48px(竖屏9:16下适配性最佳),描边粗细至少4px,否则小屏看不清 - 确认
字幕位置为底部居中,不要选智能避让——该功能在多角色对话场景下常误判画面主体,导致字幕飘到人物脸上
导出后发现字幕错位?优先检查这三处
错位不是渲染问题,而是上游数据链断裂。90%的情况能通过以下三项快速定位:
- 分镜节点里的
台词时间戳是否与实际配音波形吻合?可在「剪辑预览」面板拖动时间轴,对照波形峰值校验 - 配音节点是否被手动替换过?一旦你上传了自定义MP3,系统不会重新生成时间戳,必须手动生成
.srt并拖进配音节点的时间码字段 - 合成任务是否启用了
变速处理?开启智能节奏压缩后,所有时间戳会按比例缩放,但分镜节点里的原始时间戳不会自动更新










