pixtv视频生成需用半角英文双引号包裹对白以触发口型同步与配音,引号外为画面描述;须开启“音画一体”模式,否则引号无效;支持多轨语音、前缀标注(【对白】【画面】)及冒号结构化指令。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

在PixTV视频生成中,把对白和画面描述混写进同一段提示词会导致模型忽略台词、口型不同步或画面被台词干扰——必须用明确语法结构让AI识别哪部分是声音、哪部分是视觉。
用双引号包裹对白,其余为画面描述
第一步:在提示词中,所有人物说出的台词必须用英文双引号(")完整包裹,且双引号前后不留空格。例如写“她轻声说:“明天别来””,模型会将引号内内容识别为语音指令,自动触发口型同步与配音流程。
第二步:双引号外的所有文字,PixTV默认为画面生成依据——包括人物动作、场景、镜头、光影、情绪等。若未加引号,哪怕写“她说明天别来”,系统也会当作画面动作描述,不会生成语音。
第三步:同一提示词中可嵌套多组双引号,每组对应一个角色的一句台词。PixTV支持最多3个独立语音轨道,按出现顺序依次分配给画面中不同角色。若两个角色同时开口,需写成“他皱眉:“你确定?””“她垂眼:“不确定。””,模型会分轨处理并匹配口型。
注意:中文标点中的「」、【】、()或全角“”均无效,【必须使用半角英文双引号】,否则整个提示词会被当作纯画面指令处理,不触发音频生成。
用关键词前缀显式声明类型
方法一:在画面描述前加前缀【画面】,在对白前加前缀【对白】。例如:“【画面】雨夜咖啡馆,女子侧脸望窗,暖光勾边,胶片颗粒感;【对白】“我删掉了所有聊天记录。””
方法二:用【音效】+【台词】组合控制更细粒度输出。例如:“【画面】地铁车厢晃动,手机屏幕亮起未读消息;【音效】消息提示音滴一声;【台词】“他在楼下。””——此写法会额外生成环境音效,并让台词严格绑定该画面帧。
方法三:在PixTV最新版(2026年9月上线)中,支持用冒号分隔结构化指令:“角色A台词:‘等等!’;镜头:特写手部猛按电梯按钮;情绪:急促”。冒号后内容不参与语音生成,仅作用于画面。
避免常见混淆写法
不要把台词写在括号里,如“她摇头(‘我不去’)”,括号内容会被忽略。
不要用破折号引导台词,如“她忽然抬头——‘你早就知道?’”,破折号不构成语音识别信号。
不要在双引号内插入画面修饰词,如“她笑:“这个主意真棒!”(眼神闪烁)”,括号部分失效,且可能干扰语音节奏判断。
【关键前提:必须开启“音画一体”模式】——该功能位于生成页右上角开关,默认关闭。未开启时,任何带双引号的文本都仅作画面关键词提取,不会生成声音或驱动口型。











