pixtv中仅minimax h3和minimax music 3.0支持原生音视频同步生成:前者需在提示词中明确声音指令;后者需与视频节点连接后点击“导出带声视频”按钮。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

在PixTV画布中生成视频时,若需要最终输出的视频自带声音(比如旁白、对白、环境音或配乐),不能依赖通用视频模型自动合成音频,必须主动选择具备原生音视频联合生成能力的模型。
确认模型是否支持音视频同步生成
打开画布→右键添加「视频」节点→在右侧参数面板中点击「模型」下拉菜单→逐个查看模型名称后缀或图标提示。只有明确标注 【Audio+Video】 或带有声波图标(?)的模型才支持声音内嵌。GPT-Image 2.5、Nano Banana Pro 等纯图像模型不会产生任何声音;Seedance 2.5 默认无音频,需额外接音频节点。
目前平台内原生支持音视频同步输出的模型仅有 MiniMax H3 和 MiniMax Music 3.0(后者专用于音频生成,但可与视频节点直连输出带声视频)。
使用 MiniMax H3 生成带声视频
方法一:直接选用 MiniMax H3 模型
在视频节点的模型列表中找到 MiniMax H3 → 点击选中 → 在提示词末尾明确写入声音指令,例如:“一位穿蓝衬衫的主播讲解AI工具,语速适中,背景有轻微键盘敲击声” → 点击生成。这一步必须写清声音内容,否则它默认静音输出。
MiniMax H3 是当前 PixTV 唯一能在单次生成中同时建模画面运动与对应语音波形的模型,无需后期配音或音轨合成。
用 MiniMax Music 3.0 配合视频节点生成带声视频
方法二:分步联动生成
第一步:先用任意视频模型(如 Seedance 2.5)生成无声视频节点;
第二步:右键空白处→添加「音频」节点→模型选 MiniMax Music 3.0→输入与画面匹配的音频描述,例如:“女声中文旁白,语气轻快,语速140字/分钟,带0.8秒自然停顿”;
第三步:将音频节点拖拽至视频节点上方→松手→出现自动连接线→此时视频节点右下角会显示“Audio Linked”状态;
第四步:点击视频节点右上角「导出带声视频」按钮→系统自动混流并封装为 MP4。
【必须点击“导出带声视频”,而非普通导出】 否则只输出原始无声视频文件。











